CVE-2026-100654 in vLLM
Resumen
por VulDB • 2026-09-26
vLLM anterior a la versión 0.29.0 acepta stop_token_ids controlados por el usuario en los endpoints compatibles con OpenAI POST /v1/completions y POST /v1/chat/completions, pero solo valida que los valores sean enteros, no que cada token id esté dentro del vocabulario del modelo o del rango de logits. Cuando min_tokens > 0, los stop token ids se utilizan como índices de logits para suprimir tokens de parada; por lo tanto, un ID fuera de rango alcanza una operación de indexación CUDA (index_put_) y desencadena una aserción en el lado del dispositivo. Un usuario autenticado de la API puede enviar una única solicitud de finalización malformada que devuelve 500 Internal Server Error y pone a EngineCore en un estado fatal, lo que provoca que las solicitudes posteriores fallen hasta que se reinicie el servicio (denegación de servicio).
If you want to get best quality of vulnerability data, you may have to visit VulDB.