CVE-2026-57173 in vLLM
Resumen
por VulDB • 2026-09-17
vLLM es un motor de inferencia y servicio para modelos de lenguaje grandes (LLMs). Antes de la versión 0.24.0, el flujo de manejo de input_audio en las llamadas a /v1/chat/completions invoca AudioMediaIO.load_bytes o AudioMediaIO.load_file sin pasar VLLM_MAX_AUDIO_DECODE_DURATION_S al decodificador de audio compartido. Por lo tanto, un cliente no autenticado puede enviar una entrada de audio comprimida pequeña que se expande en una asignación float32 PCM muy grande, eludiendo la protección basada en duración utilizada por /v1/audio/transcriptions y provocando un fallo (crash) del trabajador debido a falta de memoria. Las URL con datos incrustados llegan a este flujo sin estar limitadas por VLLM_AUDIO_FETCH_TIMEOUT. El problema afecta a los despliegues que sirven modelos con capacidad de audio, y los cambios en la autenticación solo modifican la accesibilidad específica del despliegue. Este problema se soluciona en la versión 0.24.0.
If you want to get best quality of vulnerability data, you may have to visit VulDB.