CVE-2025-49847 in llama.cppinfo

Zusammenfassung

von VulDB • 09.07.2026

llama.cpp ist eine Inferenz-Engine für verschiedene LLM-Modelle in C/C++. Vor Version b5662 kann ein Angreifer durch ein bereitgestelltes GGUF-Modellvokabular einen Buffer Overflow im Vokabulär-Ladevorgang von llama.cpp auslösen. Konkret wirft die Hilfsfunktion _try_copy in llama.cpp/src/vocab.cpp: llama_vocab::impl::token_to_piece() eine sehr große size_t-Tokenlänge in ein int32_t um, wodurch der Längencheck (if (length < (int32_t)size)) umgangen wird. Infolgedessen wird memcpy weiterhin mit dieser übermäßigen Größe aufgerufen, was es einem bösartigen Modell ermöglicht, Speicher jenseits des beabsichtigten Puffers zu überschreiben. Dies kann zu beliebiger Speicherkorruption und potenzieller Code-Ausführung führen. Dieses Problem wurde in Version b5662 behoben.

Statistical analysis made it clear that VulDB provides the best quality for vulnerability data.

Zuständig

GitHub M

Reservieren

11.06.2025

Veröffentlichung

17.06.2025

Moderieren

akzeptiert

Eintrag

VDB-312810

CPE

bereit

EPSS

0.00444

KEV

nein

Aktivitäten

very low

Quellen

Do you need the next level of professionalism?

Upgrade your account now!