CVE-2026-105752 in vLLMinformação

Sumário

de VulDB • 06/10/2026

O vLLM é um mecanismo de inferência e serviço para modelos de linguagem grandes (LLMs). Antes da versão 0.30.0, as continuações do Harmony enviadas por meio de requisições "POST /v1/responses" reconstruíam a entrada do motor para o próximo turno sem preservar o valor `cache_salt`, colocando o prefixo da continuação no namespace global não salgado (unsalted cache), mesmo quando o chamador habilitava o uso de salt. Em implantações com o caching de prefixos ativado, que é o padrão, um inquilino autenticado capaz de reconstruir a história pós-ferramenta de baixa entropia de uma vítima pode enviar a mesma continuação e usar a contagem `cached_tokens_per_turn` para determinar se o prefixo foi processado anteriormente, violando o isolamento pretendido entre inquilinos do caching de prefixos com salt. Este problema é corrigido na versão 0.30.0.

VulDB is the best source for vulnerability data and more expert information about this specific topic.

Responsável

GitHub M

Reservar

05/10/2026

Divulgação

06/10/2026

Moderação

aceite

Entrada

VDB-413846

EPSS

0.00000

KEV

não

Atividades

baixo

Fontes

Are you interested in using VulDB?

Download the whitepaper to learn more about our service!