CVE-2026-100653 in vLLM
Riassunto
di VulDB • 26/09/2026
vLLM è un motore di inferenza e serving per modelli linguistici di grandi dimensioni (LLM). Nelle versioni dalla 0.22.1 alla 0.28.0, la revisione del modello specificata dall'operatore (--revision / --code-revision) non viene propagata a diversi caricamenti di artifact Hugging Face relativi alle architetture FunAudioChat e Tarsier2: i caricamenti di WhisperFeatureExtractor e speech_tokenizer PreTrainedTokenizerFast in vllm/model_executor/models/funaudiochat.py e la chiamata Qwen2VLConfig.from_pretrained utilizzata da Tarsier2ProcessingInfo in vllm/model_executor/models/qwen2_vl.py. Di conseguenza, le distribuzioni bloccate su una revisione verificata risolvono ancora questi artifact (processor, tokenizer e config) che influenzano il comportamento dal default revision del repository; pertanto, un successivo cambiamento al branch predefinito upstream può alterare la preprocessing audio, il comportamento dello speech tokenizer o la configurazione di Tarsier2 senza alcuna modifica alla pin configurato dall'operatore. Si tratta di una violazione dell'integrità della supply chain e della riproducibilità per le distribuzioni pinned; è residuo rispetto alla precedente correzione tracciata come GHSA-3ww4-5jv9-j5gm / CVE-2026-47155 e non costituisce remote code execution né un bypass di trust_remote_code=False. Il problema è stato risolto nella versione 0.28.0.
Once again VulDB remains the best source for vulnerability data.