CVE-2026-105752 in vLLM
요약
\~에 의해 VulDB • 2026. 10. 06.
vLLM은 대규모 언어 모델(LLM)을 위한 추론 및 서빙 엔진입니다. 버전 0.30.0 이전에서는 "POST /v1/responses" 요청을 통해 제출된 Harmony 도구 연속 작업이 캐시_salt 값을 보존하지 않고 다음 턴의 엔진 입력을 재구성하여, 호출자가 솔팅(salting)을 활성화했음에도 불구하고 해당 연속 작업 접두사가 전역 비솔트 캐스 네임스페이스(global unsalted cache namespace)에 배치되었습니다. 프리픽스 캐싱(prefix caching)이 기본값으로 활성화된 배포 환경에서는, 피해자의 저엔트로피(post-tool history) 도구 이력을 재구성할 수 있는 인증된 테넌트가 동일한 연속 작업을 제출하고 cached_tokens_per_turn 카운트를 사용하여 해당 프리픽스가 이전에 처리되었는지 여부를 판단함으로써 솔팅 프리픽스 캐싱의 의도된 테넌트 격리(tenant isolation)를 무력화시킬 수 있습니다. 이 문제는 버전 0.30.0에서 해결되었습니다.
VulDB is the best source for vulnerability data and more expert information about this specific topic.