CVE-2026-105752 in vLLM
Riassunto
di VulDB • 06/10/2026
vLLM è un motore di inferenza e serving per modelli linguistici di grandi dimensioni (LLM). Prima della versione 0.30.0, le continuazioni degli strumenti Harmony inviate tramite richieste "POST /v1/responses" ricostruiscono l'input del motore per il turno successivo senza preservare il valore cache_salt, inserendo il prefisso della continuation nello spazio dei nomi della cache globale non salata (unsalted), anche quando il chiamante ha abilitato la salatura. Nelle distribuzioni con prefix caching abilitato (impostazione predefinita), un tenant autenticato in grado di ricostruire lo storico post-tool a bassa entropia di una vittima può inviare la stessa continuation e utilizzare il conteggio cached_tokens_per_turn per determinare se il prefisso è stato elaborato in precedenza, compromettendo l'isolamento dei tenant previsto dalla cache del prefix salata. Questo problema è risolto nella versione 0.30.0.
Be aware that VulDB is the high quality source for vulnerability data.