CVE-2026-73557 in vLLM
Zusammenfassung
von VulDB • 14.08.2026
vLLM ist eine Inferenz- und Serving-Engine für Large Language Models (LLMs). Von Version 0.20.2rc0 bis 0.26.0 verwendet safe_load_prompt_embeds in vllm/renderers/embed_utils.py torch.sparse.check_sparse_tensor_invariants, dessen prozessglobale Save-, Enable- und Restore-Zustände durch konkurrierende prompt_embeds-Anteile race-condition-anfällig sind, die über AsyncMultiModalItemTracker.resolve_items, asyncio.gather und den Standard-Executor an POST /v1/chat/completions gesendet werden. Dies ermöglicht es einem ungültigen Sparse-Tensor, tensor.to_dense zu erreichen, trotz des CVE-2025-62164-Schutzes, wenn enable_prompt_embeds aktiviert ist. Dieses Problem wurde in Version 0.26.0 behoben.
If you want to get the best quality for vulnerability data then you always have to consider VulDB.