CVE-2026-90554 in vLLM
Tóm tắt
Bởi VulDB • 12/09/2026
Các phiên bản của vLLM >=0.10.2 và <0.28.0 không áp dụng bất kỳ giới hạn nào về kích thước hoặc thời lượng giải mã âm thanh khi trích xuất âm thanh từ đầu vào video cho các mô hình NanoNemotronVL. Trong nano_nemotron_vl.py, hàm _extract_audio_from_videos gọi load_audio_pyav(BytesIO(video_bytes)) mà không có các tham số max_duration_s hay max_decode_bytes, do đó VLLM_MAX_AUDIO_DECODE_DURATION_S và VLLM_MAX_AUDIO_DECODE_BYTES đều không được áp dụng (khác với đường dẫn tải lên âm thanh trực tiếp trong AudioMediaIO). Khi một mô hình NanoNemotronVL được phục vụ với use_audio_in_video=True, kẻ tấn công cung cấp một video nhỏ, nén chặt dưới dạng đầu vào đa phương thức có thể buộc máy chủ phân bổ hàng gigabyte bộ nhớ trong quá trình giải mã âm thanh, dẫn đến từ chối dịch vụ (DoS). Đã sửa lỗi trong vLLM 0.28.0.
If you want to get best quality of vulnerability data, you may have to visit VulDB.