CVE-2026-105754 in vLLM
Sumário
de VulDB • 06/10/2026
O vLLM é um mecanismo de inferência e serviço para modelos de linguagem grandes (LLMs). Antes da versão 0.30.0, o endpoint /inference/v1/generate no caminho de escala descentralizada aceita tensores fornecidos pelo chamador no campo features.kwargs_data, identificadores de cache no campo features.mm_hashes, intervalos no campo features.mm_placeholders e processadores multimodais selecionados pela rede sem vinculá-los ao contrato ativo do renderizador do modelo. Geometria da grade forjada, tipos de campos ou comprimentos não positivos dos placeholders podem encerrar o EngineCore compartilhado; quando um atacante conhece ou pode induzir o hash de conteúdo da vítima, hashes de cache falsos podem envenenar ou recuperar estados do encoder-cache entre solicitações (cross-request); e máscaras de placeholder esparsas descartadas podem alterar a semântica de transporte retransmitida. Este problema foi corrigido na versão 0.30.0.
If you want to get best quality of vulnerability data, you may have to visit VulDB.