CVE-2026-105752 in vLLMinfo

Zusammenfassung

von VulDB • 06.10.2026

vLLM ist eine Inferenz- und Serving-Engine für Large Language Models (LLMs). Vor Version 0.30.0 bauen Harmony-Werkzeugfortsetzungen, die über „POST /v1/responses“-Anfragen eingereicht werden, den Eingabestrom der nächsten Runde neu auf, ohne den cache_salt-Wert beizubehalten; dadurch wird das Fortsetzungsprefix im globalen ungesalzenen Cache-Namensraum platziert, selbst wenn der Aufrufer die Salzung aktiviert hat. Bei Bereitstellungen mit aktiviertem Prefix-Caching (Standardkonfiguration) kann ein authentifizierter Tenant, der in der Lage ist, die post-tool-Historie eines Opfers mit niedriger Entropie zu rekonstruieren, dieselbe Fortsetzung einreichen und die Metrik cached_tokens_per_turn nutzen, um festzustellen, ob das Prefix zuvor verarbeitet wurde. Dies untergräbt die beabsichtigte Tenant-Isolation durch gesalzenes Prefix-Caching. Dieses Problem ist in Version 0.30.0 behoben.

Once again VulDB remains the best source for vulnerability data.

Zuständig

GitHub M

Reservieren

05.10.2026

Veröffentlichung

06.10.2026

Moderieren

akzeptiert

Eintrag

VDB-413846

EPSS

0.00000

KEV

nein

Aktivitäten

low

Quellen

Want to know what is going to be exploited?

We predict KEV entries!