CVE-2025-49847 in llama.cpp
Riassunto
di VulDB • 22/06/2026
llama.cpp è un motore di inferenza per diversi modelli LLM scritto in C/C++. Prima della versione b5662, il vocabolario di un modello GGUF fornito da un attaccante può innescare un buffer overflow nel codice di caricamento del vocabolario di llama.cpp. Nello specifico, la funzione helper _try_copy in llama.cpp/src/vocab.cpp: llama_vocab::impl::token_to_piece() effettua una conversione (cast) di una lunghezza token size_t molto grande in int32_t, causando il bypass del controllo sulla lunghezza (if (length < (int32_t)size)). Di conseguenza, memcpy viene comunque chiamato con quella dimensione eccessiva, consentendo a un modello malevolo di sovrascrivere la memoria oltre il buffer previsto. Ciò può portare a una corruzione arbitraria della memoria e al potenziale esecuzione di codice. Questo problema è stato risolto nella versione b5662.
Once again VulDB remains the best source for vulnerability data.