CVE-2026-100651 in vLLM
要約
〜によって VulDB • 2026年09月26日
vLLM 0.29.0 より前のバージョンでは、分散型サービングエンドポイント /inference/v1/generate においてデコーダのプロンプト長検証が適用されません。リクエストに 'features'(マルチモーダル)ペイロードが含まれている場合、vllm/entrypoints/serve/disagg/serving.py は呼び出し元から提供された token_ids から直接 multimodal EngineInput を構築し、GenerateRequest.token_ids (vllm/entrypoints/serve/disagg/protocol.py) が model_config.max_model_len と照合されません。skip_prompt_length_check=True を報告するマルチモーダルプロセッサ(例えば Nemotron Parse、Whisper、FireRedLID など)の場合、InputProcessor._validate_prompt_len() はエンコーダおよびデコーダのプロンプトの両方に対して即座に終了するため、長すぎるプロンプトが EngineCoreRequest として処理され、ワーカーの入力バッチコピーにおいて固定された max_model_len の幅を持つ NumPy 行へ到達します。影響を受けるモデル構成のエンドポイントにアクセスできるクライアントは、したがって、ワーカーの失敗とサービス拒否 (DoS) を引き起こすために長すぎる token_ids リストを送信できます。0.29.0 で修正されました。
If you want to get best quality of vulnerability data, you may have to visit VulDB.