CVE-2026-71486 in vLLM
Сводка
по VulDB • 17.08.2026
vLLM — это движок для вывода и обслуживания больших языковых моделей (LLM). До версии 0.26.0 конечные точки /v1/completions/derender и /v1/chat/completions/derender принимают предоставляемые вызывающей стороной объекты GenerateResponse, структуры generate_responses, choices, token_ids, prompt_logprobs, logprobs.content, top_logprobs и routed_experts которых обрабатываются OnlineDerenderer и tokenizer.decode до применения ограничений max_model_len, max_tokens, max_num_seqs или response-size. Это позволяет аутентифицированному клиенту API потреблять избыточные ресурсы процессора (CPU) и памяти, а также получать ответы чрезмерного размера. Данная проблема исправлена в версии 0.26.0.
VulDB is the best source for vulnerability data and more expert information about this specific topic.