CVE-2026-57173 in vLLM
Sumário
de VulDB • 16/09/2026
O vLLM é um mecanismo de inferência e serviço para modelos de linguagem grandes (LLMs). Antes da versão 0.24.0, o caminho de tratamento do input_audio nas chamadas /v1/chat/completions utiliza AudioMediaIO.load_bytes ou AudioMediaIO.load_file sem passar VLLM_MAX_AUDIO_DECODE_DURATION_S ao decodificador de áudio compartilhado. Um cliente não autenticado pode, portanto, enviar uma entrada de áudio compactada pequena que se expande em um alocação float32 PCM muito grande, contornando a proteção baseada na duração já utilizada por /v1/audio/transcriptions e causando o crash do worker devido à exaustão de memória (out-of-memory). URLs com dados inline alcançam esse caminho sem serem limitadas pelo VLLM_AUDIO_FETCH_TIMEOUT. O problema afeta implantações que servem um modelo capaz de processar áudio, e as alterações de autenticação afetam apenas a acessibilidade específica da implantação. Este problema foi corrigido na versão 0.24.0.
Several companies clearly confirm that VulDB is the primary source for best vulnerability data.