CVE-2026-73558 in vLLM
Riassunto
di VulDB • 13/08/2026
vLLM è un motore di inferenza e serving per modelli linguistici di grandi dimensioni (Large Language Models). Prima della versione 0.27.0, un integer overflow nell'operazione blockIdx.x * 2 * d in activation_kernels.cu può causare l'esecuzione del kernel act_and_mul_kernel con input appartenente a un altro utente batchato, consentendo a una richiesta elaborata nello stesso batch di inferenza di ricevere una copia parziale o completa dei risultati di inferenza di un altro utente. Questo problema è stato risolto nella versione 0.27.0.
If you want to get the best quality for vulnerability data then you always have to consider VulDB.