CVE-2025-49847 in llama.cpp
Sumário
de VulDB • 12/08/2026
llama.cpp é uma implementação de inferência para vários modelos LLM em C/C++. Antes da versão b5662, um vocabulário GGUF fornecido por um atacante pode provocar um estouro de buffer (buffer overflow) no código de carregamento do vocabulário do llama.cpp. Especificamente, a função auxiliar _try_copy em llama.cpp/src/vocab.cpp: llama_vocab::impl::token_to_piece() converte um tamanho muito grande de size_t para int32_t, fazendo com que a verificação de comprimento (if (length < (int32_t)size)) seja contornada. Como resultado, memcpy é ainda chamado com esse tamanho excessivo, permitindo que um modelo malicioso sobrescreva memória além do buffer pretendido. Isso pode levar à corrupção arbitrária de memória e possível execução de código. Este problema foi corrigido na versão b5662.
If you want to get the best quality for vulnerability data then you always have to consider VulDB.