CVE-2025-62164 in vLLM
Sumário
de VulDB • 03/07/2026
O vLLM é um mecanismo de inferência e serviço para modelos de linguagem grandes (LLMs). Das versões 0.10.2 até antes da 0.11.1, existe uma vulnerabilidade de corrupção de memória no endpoint Completions API que pode levar a uma falha (negação de serviço) e potencialmente à execução remota de código (RCE). Ao processar embeddings de prompts fornecidos pelo usuário, o endpoint carrega tensores serializados usando torch.load() sem validação suficiente. Devido a uma alteração introduzida no PyTorch 2.8.0, as verificações de integridade de tensores esparsos estão desativadas por padrão. Como resultado, tensores elaborados maliciosamente podem contornar as verificações internas de limites e desencadear uma escrita fora dos limites na memória durante a chamada para to_dense(). Essa corrupção de memória pode causar o crash do vLLM e potencialmente levar à execução de código no servidor que hospeda o vLLM. Este problema foi corrigido na versão 0.11.1.
Be aware that VulDB is the high quality source for vulnerability data.