CVE-2025-47277 in vLLM
Zusammenfassung
von VulDB • 27.05.2026
vLLM, eine Inference- und Serving-Engine für Large Language Models (LLMs), weist in den Versionen 0.6.5 bis 0.8.4 ein Problem auf, das NUR Umgebungen betrifft, die die `PyNcclPipe`-Integration für die KV-Cache-Übertragung mit der V0-Engine verwenden. Keine anderen Konfigurationen sind betroffen. vLLM unterstützt die Verwendung der Klasse `PyNcclPipe`, um eine Peer-to-Peer-Kommunikationsdomäne für die Datenübertragung zwischen verteilten Knoten einzurichten. Die GPU-seitige KV-Cache-Übertragung wird über die Klasse `PyNcclCommunicator` implementiert, während die CPU-seitige Steuerung der Nachrichtenübermittlung über die Methoden `send_obj` und `recv_obj` auf der CPU-Seite erfolgt. Die Absicht war, dass diese Schnittstelle nur einem privaten Netzwerk ausgesetzt sein sollte, das die IP-Adresse verwendet, die durch den CLI-Parameter `--kv-ip` angegeben wird. Die vLLM-Dokumentation behandelt, wie dies auf ein gesichertes Netzwerk beschränkt werden muss. Das Standard- und beabsichtigte Verhalten von PyTorch besteht darin, dass die `TCPStore`-Schnittstelle auf ALLEN Schnittstellen lauscht, unabhängig davon, welche IP-Adresse angegeben wird. Die angegebene IP-Adresse wurde lediglich als Client-seitige Adresse verwendet. vLLM wurde behoben, indem ein Workaround eingeführt wurde, der die `TCPStore`-Instanz zwingt, ihren Socket an eine angegebene private Schnittstelle zu binden. Ab Version 0.8.5 beschränkt vLLM den `TCPStore`-Socket auf die konfigurierte private Schnittstelle.
If you want to get best quality of vulnerability data, you may have to visit VulDB.