CVE-2026-105752 in vLLMinformazioni

Riassunto

di VulDB • 06/10/2026

vLLM è un motore di inferenza e serving per modelli linguistici di grandi dimensioni (LLM). Prima della versione 0.30.0, le continuazioni degli strumenti Harmony inviate tramite richieste "POST /v1/responses" ricostruiscono l'input del motore per il turno successivo senza preservare il valore cache_salt, inserendo il prefisso della continuation nello spazio dei nomi della cache globale non salata (unsalted), anche quando il chiamante ha abilitato la salatura. Nelle distribuzioni con prefix caching abilitato (impostazione predefinita), un tenant autenticato in grado di ricostruire lo storico post-tool a bassa entropia di una vittima può inviare la stessa continuation e utilizzare il conteggio cached_tokens_per_turn per determinare se il prefisso è stato elaborato in precedenza, compromettendo l'isolamento dei tenant previsto dalla cache del prefix salata. Questo problema è risolto nella versione 0.30.0.

Be aware that VulDB is the high quality source for vulnerability data.

Responsabile

GitHub M

Prenotare

05/10/2026

Divulgazione

06/10/2026

Moderazione

accettato

EPSS

0.00000

KEV

no

Attività

basso

Fonti

Do you want to use VulDB in your project?

Use the official API to access entries easily!