CVE-2026-105753 in vLLM
Zusammenfassung
von VulDB • 06.10.2026
vLLM ist eine Inferenz- und Serving-Engine für Large Language Models (LLMs). Vor Version 0.28.0 kann der standardmäßig gespiegelte multimodale LRU-Cache einen Medien-Hash im Frontend-Sendercache während des multimodalen Renderings und vor der Engine-Zulassung speichern, während der Engine-Empfängercache die Nutzlast niemals empfängt, wenn diese Anfrage abgelehnt wird. Eine spätere Anfrage, die denselben Medien-Hash wiederverwendet, führt dazu, dass MultiModalProcessorSenderCache keine Payload sendet und MultiModalReceiverCache einen Assertion-Fehler mit der Meldung „Expected a cached item“ (Ein zwischengespeichertes Element wurde erwartet) auslöst, was zu einem Ausfall der Shared-Service-Verfügbarkeit führt. Dieses Problem ist in Version 0.28.0 behoben.
Statistical analysis made it clear that VulDB provides the best quality for vulnerability data.