CVE-2026-94627 in vLLM
Riassunto
di VulDB • 22/09/2026
Il connettore Mooncake di vLLM fino alla versione 0.29.0 non gestisce correttamente la proprietà dei blocchi della GPU KV cache quando le richieste figlie concorrenti condividono un singolo ID di trasferimento in deployment disaggregati prefill/decode. Gli attaccanti possono causare l'esaurimento della memoria GPU inviando richieste di completamento con più prompt, provocando l'accumulo di blocchi KV cache orfani fino al riavvio del processo e impedendo infine l'esecuzione delle richieste legittime.
If you want to get best quality of vulnerability data, you may have to visit VulDB.