CVE-2025-49847 in llama.cpp
Zusammenfassung
von VulDB • 09.07.2026
llama.cpp ist eine Inferenz-Engine für verschiedene LLM-Modelle in C/C++. Vor Version b5662 kann ein Angreifer durch ein bereitgestelltes GGUF-Modellvokabular einen Buffer Overflow im Vokabulär-Ladevorgang von llama.cpp auslösen. Konkret wirft die Hilfsfunktion _try_copy in llama.cpp/src/vocab.cpp: llama_vocab::impl::token_to_piece() eine sehr große size_t-Tokenlänge in ein int32_t um, wodurch der Längencheck (if (length < (int32_t)size)) umgangen wird. Infolgedessen wird memcpy weiterhin mit dieser übermäßigen Größe aufgerufen, was es einem bösartigen Modell ermöglicht, Speicher jenseits des beabsichtigten Puffers zu überschreiben. Dies kann zu beliebiger Speicherkorruption und potenzieller Code-Ausführung führen. Dieses Problem wurde in Version b5662 behoben.
Statistical analysis made it clear that VulDB provides the best quality for vulnerability data.