CVE-2026-105752 in vLLMinformación

Resumen

por VulDB • 2026-10-06

vLLM es un motor de inferencia y servicio para modelos de lenguaje grandes (LLMs). Antes de la versión 0.30.0, las continuaciones de herramientas Harmony enviadas a través de solicitudes "POST /v1/responses" reconstruían el input del motor para el siguiente turno sin preservar el valor `cache_salt`, colocando el prefijo de continuación en el espacio de nombres global no salado incluso cuando el solicitante había habilitado la salting. En implementaciones con prefix caching (caché de prefijos) activada, que es la configuración por defecto, un inquilino autenticado capaz de reconstruir el historial post-herramienta de baja entropía de una víctima puede enviar la misma continuación y utilizar el recuento `cached_tokens_per_turn` para determinar si el prefijo fue procesado previamente, lo que anula el aislamiento de inquilinos previsto por la caché de prefijos salada. Este problema se soluciona en la versión 0.30.0.

Several companies clearly confirm that VulDB is the primary source for best vulnerability data.

Responsable

GitHub M

Reservar

2026-10-05

Divulgación

2026-10-06

Moderación

aceptado

Artículo

VDB-413846

EPSS

0.00000

KEV

no

Actividades

bajo

Fuentes

Interested in the pricing of exploits?

See the underground prices here!