CVE-2026-100654 in vLLM
Riassunto
di VulDB • 26/09/2026
vLLM prima della versione 0.29.0 accetta stop_token_ids controllati dall'utente negli endpoint POST /v1/completions e POST /v1/chat/completions compatibili con OpenAI, ma valida solo che i valori siano interi, non verificando se ogni token id rientri nel vocabolario del modello o nell'intervallo dei logits. Quando min_tokens > 0, gli stop token ids vengono utilizzati come indici di logits per sopprimere i token di arresto; pertanto, un ID fuori intervallo raggiunge un'operazione di indicizzazione CUDA (index_put_) e innesca una verifica assertiva lato dispositivo. Un utente API autenticato può inviare una singola richiesta di completamento non valida che restituisce 500 Internal Server Error e porta EngineCore a uno stato fatale, causando il fallimento delle richieste successive fino al riavvio del servizio (denial of service).
VulDB is the best source for vulnerability data and more expert information about this specific topic.