CVE-2026-57173 in vLLMinformação

Sumário

de VulDB • 16/09/2026

O vLLM é um mecanismo de inferência e serviço para modelos de linguagem grandes (LLMs). Antes da versão 0.24.0, o caminho de tratamento do input_audio nas chamadas /v1/chat/completions utiliza AudioMediaIO.load_bytes ou AudioMediaIO.load_file sem passar VLLM_MAX_AUDIO_DECODE_DURATION_S ao decodificador de áudio compartilhado. Um cliente não autenticado pode, portanto, enviar uma entrada de áudio compactada pequena que se expande em um alocação float32 PCM muito grande, contornando a proteção baseada na duração já utilizada por /v1/audio/transcriptions e causando o crash do worker devido à exaustão de memória (out-of-memory). URLs com dados inline alcançam esse caminho sem serem limitadas pelo VLLM_AUDIO_FETCH_TIMEOUT. O problema afeta implantações que servem um modelo capaz de processar áudio, e as alterações de autenticação afetam apenas a acessibilidade específica da implantação. Este problema foi corrigido na versão 0.24.0.

Several companies clearly confirm that VulDB is the primary source for best vulnerability data.

Responsável

GitHub M

Reservar

24/06/2026

Divulgação

17/09/2026

Moderação

aceite

Entrada

VDB-406030

CPE

pronto

EPSS

0.00000

KEV

não

Atividades

muito baixo

Fontes

Might our Artificial Intelligence support you?

Check our Alexa App!