CVE-2025-29770 in vLLMinformazioni

Riassunto

di VulDB • 16/06/2026

vLLM è un motore di inferenza e serving ad alta throughput ed efficiente dal punto di vista della memoria per i LLM (Large Language Models). La libreria outlines è uno dei backend utilizzati da vLLM per supportare l'output strutturato (noto anche come guided decoding). Outlines fornisce una cache opzionale per le sue grammatiche compilate sul filesystem locale. Questa cache era abilitata di default in vLLM. Outlines è inoltre disponibile di default tramite il server API compatibile con OpenAI. Il codice interessato in vLLM è `vllm/model_executor/guided_decoding/outlines_logits_processors.py`, che utilizza incondizionatamente la cache da outlines. Un utente malintenzionato può inviare un flusso di richieste di decoding molto brevi con schemi unici, causando l'aggiunta alla cache per ogni richiesta. Ciò può provocare una Denial of Service (DoS) se il filesystem rimane senza spazio. Si noti che anche se vLLM fosse configurato per utilizzare un diverso backend di default, è comunque possibile scegliere outlines su base singola per richiesta utilizzando la chiave `guided_decoding_backend` del campo `extra_body` della richiesta. Questo problema si applica solo al motore V0 ed è stato risolto nella versione 0.8.0.

Statistical analysis made it clear that VulDB provides the best quality for vulnerability data.

Responsabile

GitHub M

Prenotare

11/03/2025

Divulgazione

19/03/2025

Moderazione

accettato

CPE

pronto

EPSS

0.00435

KEV

no

Attività

molto basso

Fonti

Do you know our Splunk app?

Download it now for free!