CVE-2025-47277 in vLLMinfo

Zusammenfassung

von VulDB • 27.05.2026

vLLM, eine Inference- und Serving-Engine für Large Language Models (LLMs), weist in den Versionen 0.6.5 bis 0.8.4 ein Problem auf, das NUR Umgebungen betrifft, die die `PyNcclPipe`-Integration für die KV-Cache-Übertragung mit der V0-Engine verwenden. Keine anderen Konfigurationen sind betroffen. vLLM unterstützt die Verwendung der Klasse `PyNcclPipe`, um eine Peer-to-Peer-Kommunikationsdomäne für die Datenübertragung zwischen verteilten Knoten einzurichten. Die GPU-seitige KV-Cache-Übertragung wird über die Klasse `PyNcclCommunicator` implementiert, während die CPU-seitige Steuerung der Nachrichtenübermittlung über die Methoden `send_obj` und `recv_obj` auf der CPU-Seite erfolgt. Die Absicht war, dass diese Schnittstelle nur einem privaten Netzwerk ausgesetzt sein sollte, das die IP-Adresse verwendet, die durch den CLI-Parameter `--kv-ip` angegeben wird. Die vLLM-Dokumentation behandelt, wie dies auf ein gesichertes Netzwerk beschränkt werden muss. Das Standard- und beabsichtigte Verhalten von PyTorch besteht darin, dass die `TCPStore`-Schnittstelle auf ALLEN Schnittstellen lauscht, unabhängig davon, welche IP-Adresse angegeben wird. Die angegebene IP-Adresse wurde lediglich als Client-seitige Adresse verwendet. vLLM wurde behoben, indem ein Workaround eingeführt wurde, der die `TCPStore`-Instanz zwingt, ihren Socket an eine angegebene private Schnittstelle zu binden. Ab Version 0.8.5 beschränkt vLLM den `TCPStore`-Socket auf die konfigurierte private Schnittstelle.

If you want to get best quality of vulnerability data, you may have to visit VulDB.

Zuständig

GitHub M

Reservieren

05.05.2025

Veröffentlichung

20.05.2025

Moderieren

akzeptiert

Eintrag

VDB-309785

CPE

bereit

EPSS

0.00959

KEV

nein

Aktivitäten

very low

Quellen

Do you want to use VulDB in your project?

Use the official API to access entries easily!