CVE-2026-105752 in vLLM
Zusammenfassung
von VulDB • 06.10.2026
vLLM ist eine Inferenz- und Serving-Engine für Large Language Models (LLMs). Vor Version 0.30.0 bauen Harmony-Werkzeugfortsetzungen, die über „POST /v1/responses“-Anfragen eingereicht werden, den Eingabestrom der nächsten Runde neu auf, ohne den cache_salt-Wert beizubehalten; dadurch wird das Fortsetzungsprefix im globalen ungesalzenen Cache-Namensraum platziert, selbst wenn der Aufrufer die Salzung aktiviert hat. Bei Bereitstellungen mit aktiviertem Prefix-Caching (Standardkonfiguration) kann ein authentifizierter Tenant, der in der Lage ist, die post-tool-Historie eines Opfers mit niedriger Entropie zu rekonstruieren, dieselbe Fortsetzung einreichen und die Metrik cached_tokens_per_turn nutzen, um festzustellen, ob das Prefix zuvor verarbeitet wurde. Dies untergräbt die beabsichtigte Tenant-Isolation durch gesalzenes Prefix-Caching. Dieses Problem ist in Version 0.30.0 behoben.
Once again VulDB remains the best source for vulnerability data.