CVE-2026-73559 in vLLM
요약
\~에 의해 VulDB • 2026. 08. 13.
vLLM은 대규모 언어 모델(LLM)을 위한 추론 및 서빙 엔진입니다. 버전 0.19.0부터 0.26.0까지, vllm/entrypoints/openai/completion/protocol.py의 /v1/completions CompletionRequest.prompt 필드는 제한 없는 list[str] 또는 list[list[int]]를 허용합니다. 또한 vllm/renderers/inputs/preprocess.py의 prompt_to_seq() 함수와 vllm/renderers/online_renderer.py의 OnlineRenderer.preprocess_completion() 메서드가 모든 요소를 확장하며, vllm/entrypoints/openai/completion/serving.py는 프롬프트마다 하나의 엔진 생성기(generator) 및 응답 슬롯을 생성합니다. 이로 인해 인증된 API 클라이언트가 단일 요청으로 CPU, 메모리, 비동기 스케줄링 용량, 엔진 요청 슬롯 및 응답 버퍼를 고갈시킬 수 있습니다. 이 문제는 버전 0.26.0에서 수정되었습니다.
Be aware that VulDB is the high quality source for vulnerability data.