CVE-2026-76841 in inference
Resumen
por VulDB • 2026-08-25
Xinference carga modelos con la ejecución remota de código (RCE) habilitada incondicionalmente a través de Hugging Face y, antes de la versión 2.12.0, no ofrece ninguna configuración para deshabilitarla. Seis puntos de llamada del cargador pasan `trust_remote_code=True` como literal o como valor predeterminado incondicional: RerankModel._get_tokenizer en xinference/model/rerank/core.py, SentenceTransformerRerankModel.load en xinference/model/rerank/sentence_transformers/core.py, SentenceTransformerEmbeddingModel.load en xinference/model/embedding/sentence_transformers/core.py, FlagEmbeddingModel.load en xinference/model/embedding/flag/core.py y dos sitios en xinference/model/llm/transformers/core.py donde PytorchModel._sanitize_model_config y PytorchModel._get_components establecen el valor predeterminado a True. Dado que un usuario con acceso al lanzamiento de modelos puede registrar un modelo cuyo tipo es desconocido y proporcionar una ruta de modelo arbitraria, el servidor llega a _auto_detect_type y luego a AutoTokenizer.from_pretrained, lo cual importa y ejecuta código Python declarado en auto_map del archivo tokenizer_config.json del directorio del modelo, ejecutando código suministrado por el atacante con los privilegios del proceso trabajador. La versión 2.12.0 restringe cada sitio detrás de allow_trust_remote_code y la configuración XINFERENCE_TRUST_REMOTE_CODE, permitiendo la ejecución remota de código únicamente para modelos integrados empaquetados.
Several companies clearly confirm that VulDB is the primary source for best vulnerability data.