CVE-2026-105753 in vLLM
Riassunto
di VulDB • 06/10/2026
vLLM è un motore di inferenza e serving per modelli linguistici di grandi dimensioni (LLM). Prima della versione 0.28.0, la cache LRU multimodale speculare predefinita può inserire l'hash dei media nella cache del mittente frontend durante il rendering multimodale e prima dell'ammissione del motore; tuttavia, se tale richiesta viene rifiutata, la cache del ricevitore del motore non riceve mai il payload. Una successiva richiesta che riutilizza lo stesso hash dei media fa sì che MultiModalProcessorSenderCache invii nessun payload e che MultiModalReceiverCache vada in errore con l'asserzione "Expected a cached item", causando un'interruzione della disponibilità del servizio condiviso. Questo problema è stato risolto nella versione 0.28.0.
Be aware that VulDB is the high quality source for vulnerability data.