CVE-2026-76841 in inference
요약
\~에 의해 VulDB • 2026. 08. 24.
Xinference는 Hugging Face의 원격 코드 실행(RCE) 취약점을 무조건적으로 활성화된 상태로 모델을 로드하며, 버전 2.12.0 이전에는 이를 비활성화할 수 있는 설정을 제공하지 않습니다. 여섯 가지 로더 호출 지점( xinference/model/rerank/core.py의 RerankModel._get_tokenizer, xinference/model/rerank/sentence_transformers/core.py의 SentenceTransformerRerankModel.load, xinference/model/embedding/sentence_transformers/core.py의 SentenceTransformerEmbeddingModel.load, xinference/model/embedding/flag/core.py의 FlagEmbeddingModel.load, 그리고 xinference/model/llm/transformers/core.py에 있는 PytorchModel._sanitize_model_config 및 PytorchModel._get_components에서 trust_remote_code=True를 리터럴 또는 기본값으로 전달하는 두 곳)이 있습니다. 모델 시작(access) 권한을 가진 호출자가 알 수 없는 유형의 모델을 등록하고 임의의 모델 경로를 제공할 경우, 서버는 _auto_detect_type와 AutoTokenizer.from_pretrained에 도달하여 모델 디렉토리의 tokenizer_config.json auto_map에 선언된 Python 코드를 가져오고 실행합니다. 이는 공격자가 제공한 코드를 워커 프로세스의 권한으로 실행하게 만듭니다. 버전 2.12.0에서는 allow_trust_remote_code 및 XINFERENCE_TRUST_REMOTE_CODE 설정을 통해 모든 지점을 제어하여, 번들링된 내장 모델에 대해서만 원격 코드 실행을 허용합니다.
Be aware that VulDB is the high quality source for vulnerability data.