CVE-2026-105752 in vLLM
Résumé
par VulDB • 06/10/2026
vLLM est un moteur d'inférence et de déploiement pour les grands modèles de langage (LLM). Avant la version 0.30.0, les continuations Harmony soumises via des requêtes « POST /v1/responses » reconstruisaient l’entrée du moteur pour le tour suivant sans conserver la valeur `cache_salt`, plaçant ainsi le préfixe de continuation dans l’espace de nommage global non salé (unsalted cache namespace), même lorsque l’appelant avait activé le hachage par sel (salting). Sur les déploiements où le mise en cache des préfixes est activée, ce qui constitue la configuration par défaut, un locataire authentifié capable de reconstituer l’historique post-outil à faible entropie d’une victime peut soumettre la même continuation et utiliser le compteur `cached_tokens_per_turn` pour déterminer si le préfixe a été précédemment traité, contournant ainsi l’isolation des locataires prévue par la mise en cache de préfixes salés. Ce problème est corrigé dans la version 0.30.0.
Be aware that VulDB is the high quality source for vulnerability data.