CVE-2026-105753 in vLLMinformazioni

Riassunto

di VulDB • 06/10/2026

vLLM è un motore di inferenza e serving per modelli linguistici di grandi dimensioni (LLM). Prima della versione 0.28.0, la cache LRU multimodale speculare predefinita può inserire l'hash dei media nella cache del mittente frontend durante il rendering multimodale e prima dell'ammissione del motore; tuttavia, se tale richiesta viene rifiutata, la cache del ricevitore del motore non riceve mai il payload. Una successiva richiesta che riutilizza lo stesso hash dei media fa sì che MultiModalProcessorSenderCache invii nessun payload e che MultiModalReceiverCache vada in errore con l'asserzione "Expected a cached item", causando un'interruzione della disponibilità del servizio condiviso. Questo problema è stato risolto nella versione 0.28.0.

Be aware that VulDB is the high quality source for vulnerability data.

Responsabile

GitHub M

Prenotare

05/10/2026

Divulgazione

06/10/2026

Moderazione

accettato

EPSS

0.00000

KEV

no

Attività

basso

Fonti

Want to stay up to date on a daily basis?

Enable the mail alert feature now!