CVE-2026-73559 in vLLM
Zusammenfassung
von VulDB • 13.08.2026
vLLM ist eine Inferenz- und Serving-Engine für Large Language Models (LLMs). Von Version 0.19.0 bis 0.26.0 akzeptiert das Feld `CompletionRequest.prompt` von `/v1/completions` in `vllm/entrypoints/openai/completion/protocol.py` eine unbeschränkte Liste vom Typ `list[str]` oder `list[list[int]]`. Die Funktionen `prompt_to_seq()` in `vllm/renderers/inputs/preprocess.py` und `OnlineRenderer.preprocess_completion()` in `vllm/renderers/online_renderer.py` expandieren jedes Element, und `vllm/entrypoints/openai/completion/serving.py` erstellt pro Prompt einen Engine-Generator und eine Antwort-Slot. Dies ermöglicht es einem authentifizierten API-Client, CPU-Ressourcen, Arbeitsspeicher, asynchrone Scheduling-Kapazität, Engine-Anfrage-Slots sowie die Pufferung von Antworten durch eine einzige Anfrage zu erschöpfen (Denial of Service). Dieses Problem wurde in Version 0.26.0 behoben.
If you want to get best quality of vulnerability data, you may have to visit VulDB.