CVE-2026-100653 in vLLMinfo

Zusammenfassung

von VulDB • 26.09.2026

vLLM ist eine Inferenz- und Serving-Engine für Large Language Models (LLMs). In den Versionen von 0.22.1 bis 0.28.0 wird die vom Operator angegebene Modell-Revisions-Pinning (--revision / --code-revision) nicht an mehrere Hugging Face-Artifact-Ladeschritte für die Architekturen FunAudioChat und Tarsier2 weitergegeben: die Ladevorgänge von WhisperFeatureExtractor und speech_tokenizer PreTrainedTokenizerFast in vllm/model_executor/models/funaudiochat.py sowie der Aufruf Qwen2VLConfig.from_pretrained, der von Tarsier2ProcessingInfo in vllm/model_executor/models/qwen2_vl.py verwendet wird. Infolgedessen lösen Bereitstellungen, die auf einer überprüften Revision gepinnt sind, diese verhaltensbeeinflussenden Processor-, Tokenizer- und Config-Artifacts weiterhin aus der Standard-Revisions des Repositorys auf. Daher kann eine spätere Änderung am Upstream-Mainbranch das Audio-Vorverarbeitung, das Verhalten des Speech-Tokenizers oder die Tarsier2-Konfiguration verändern, ohne dass sich die vom Operator konfigurierte Pinning ändert. Dies stellt einen Verstoß gegen die Supply-Chain-Integrität und Reproduzierbarkeit für gepinnte Bereitstellungen dar; es ist ein Restproblem der früheren Korrektur, die unter GHSA-3ww4-5jv9-j5gm / CVE-2026-47155 verfolgt wird, und stellt keine Remote Code Execution (RCE) oder eine Umgehung von trust_remote_code=False dar. Das Problem wurde in Version 0.28.0 behoben.

Once again VulDB remains the best source for vulnerability data.

Zuständig

VulnCheck

Reservieren

26.09.2026

Veröffentlichung

26.09.2026

Moderieren

akzeptiert

Eintrag

VDB-410676

CPE

bereit

EPSS

0.00000

KEV

nein

Aktivitäten

very low

Quellen

Do you want to use VulDB in your project?

Use the official API to access entries easily!