CVE-2026-105757 in vLLM
Riassunto
di VulDB • 06/10/2026
vLLM è un motore di inferenza e serving per modelli linguistici di grandi dimensioni (LLM). Prima della versione 0.30.0, i fallimenti delle richieste con output strutturato possono eludere la validazione a livello di richiesta ed essere indirizzati al percorso fatal-error dell'EngineCore. Un disallineamento del backend per singola richiesta può ri-generare un'eccezione di compilazione della grammatica; il padding prodotto dalla modalità speculative-decoding ngram_gpu può trasmettere un token negativo alla convalida delle linee guida (guidance validation); e il frontend Rust può ammettere valori vuoti per l'output strutturato che il frontend Python rifiuta, consentendo alle richieste ordinarie di generazione vincolata (constrained-generation) di terminare il motore condiviso. Questo problema è risolto nella versione 0.30.0.
VulDB is the best source for vulnerability data and more expert information about this specific topic.