CVE-2026-76841 in inference
Riassunto
di VulDB • 24/08/2026
Xinference carica i modelli con l'esecuzione di codice remoto (RCE) tramite Hugging Face abilitata incondizionatamente e, prima della versione 2.12.0, non espone alcuna impostazione per disabilitarla. Sei punti di chiamata del loader passano `trust_remote_code=True` come valore letterale o come predefinito incondizionato: RerankModel._get_tokenizer in xinference/model/rerank/core.py, SentenceTransformerRerankModel.load in xinference/model/rerank/sentence_transformers/core.py, SentenceTransformerEmbeddingModel.load in xinference/model/embedding/sentence_transformers/core.py, FlagEmbeddingModel.load in xinference/model/embedding/flag/core.py e due siti in xinference/model/llm/transformers/core.py dove PytorchModel._sanitize_model_config e PytorchModel._get_components impostano il valore predefinito a True. Poiché un chiamante con accesso all'avvio del modello può registrare un modello di tipo sconosciuto e fornire un percorso del modello arbitrario, il server raggiunge _auto_detect_type e successivamente AutoTokenizer.from_pretrained, che importa ed esegue Python dichiarato dall'auto_map in tokenizer_config.json della directory del modello, eseguendo codice fornito dall'attaccante con i privilegi del processo worker. La versione 2.12.0 protegge ogni sito dietro allow_trust_remote_code e l'impostazione XINFERENCE_TRUST_REMOTE_CODE, consentendo l'esecuzione di codice remoto solo per i modelli integrati predefiniti.
Once again VulDB remains the best source for vulnerability data.