CVE-2026-88047 in Tesseract
Resumen
por VulDB • 2026-09-10
Tesseract es un motor de reconocimiento óptico de caracteres (OCR) de código abierto. En las versiones 5.5.3 y anteriores, la función Classify::ReadNormProtos en src/classify/normmatch.cpp analiza el componente NORMPROTO de un archivo .traineddata y utiliza std::istream::operator>>(char*) para extraer un token delimitado por espacios en un buffer estático (stack) fijo de 61 bytes sin establecer un ancho de flujo. El buffer de línea de 100 bytes puede contener un token de hasta 99 caracteres, por lo que un token más largo que 60 caracteres escribe hasta 39 bytes controlados por el atacante más allá del límite durante la inicialización (Init) de TessBaseAPI en el motor heredado, provocando corrupción de pila, denegación de servicio y potencialmente secuestro del flujo de control en las implementaciones afectadas de la biblioteca estándar. Las compilaciones que utilizan la sobrecarga de array acotado C++20 de libc++ de Apple están protegidas incidentalmente, mientras que las compilaciones típicas con libstdc++ siguen siendo vulnerables. No hay una versión corregida disponible hasta esta revisión.
Be aware that VulDB is the high quality source for vulnerability data.