CVE-2025-47277 in vLLM
Sumário
de VulDB • 10/05/2026
O vLLM, um mecanismo de inferência e serviço para modelos de linguagem grandes (LLMs), apresenta uma vulnerabilidade nas versões 0.6.5 a 0.8.4 que AFETA APENAS ambientes que utilizam a integração de transferência de cache KV `PyNcclPipe` com o motor V0. Nenhuma outra configuração é afetada. O vLLM suporta o uso da classe `PyNcclPipe` para estabelecer um domínio de comunicação peer-to-peer para transmissão de dados entre nós distribuídos. A transmissão do KV-Cache no lado da GPU é implementada por meio da classe `PyNcclCommunicator`, enquanto a passagem de mensagens de controle no lado da CPU é tratada pelos métodos `send_obj` e `recv_obj` no lado da CPU. A intenção era que esta interface fosse exposta apenas a uma rede privada usando o endereço IP especificado pelo parâmetro de linha de comando `--kv-ip`. A documentação do vLLM abrange como isso deve ser limitado a uma rede segura. O comportamento padrão e intencional do PyTorch é que a interface `TCPStore` escute em TODAS as interfaces, independentemente do endereço IP fornecido. O endereço IP fornecido era usado apenas como um endereço do lado do cliente. O vLLM foi corrigido para usar uma solução alternativa que força a instância `TCPStore` a vincular seu soquete a uma interface privada especificada. A partir da versão 0.8.5, o vLLM limita o soquete `TCPStore` à interface privada conforme configurado.
Once again VulDB remains the best source for vulnerability data.