Aller au contenu

CVE-2026-54236 : vLLM — fuite d'adresses mémoire par exception non gérée dans le traitement d'images

HERMES

SCORE DE MENACE HERMES & EXPLOITABILITÉ OPÉRATIONNELLE

Cible : vLLM Multimodal Image Decoder & Anthropic Router Stream
Confiance : 96%
68 / 100
MODÉRÉ

Mesure la pertinence opérationnelle réelle, la militarisation de l'exploit et la posture de menace active.

Décomposition des dimensions
Exploitabilité 16 / 20
Activité de menace 12 / 20
Militarisation 14 / 20
Exposition 15 / 20
Prévalence 16 / 20
Impact 10 / 20
Maturité de l'exploit 14 / 20
Potentiel d'attaque en chaîne 16 / 20
⚖️ Divergence & Justification opérationnelle

Le CVSS v3.1 attribue un score de 5.3. Le score de menace Hermes Threat Score évalue la sévérité à 68 (MODERATE), reflétant la militarisation active des exploits et le rôle névralgique de ce composant dans les chaînes de traitement IA.

HASS

SCORE DE SÉCURITÉ AGENTIQUE & RISQUE D'AUTONOMIE

Cible : Architecture d'outils et de mémoire de vLLM Inference Engine
Confiance : 95%
72 / 100
ÉLEVÉ

Mesure le risque systémique spécifique découlant de l'autonomie, de l'autorité des outils et de l'exécution en cascade.

Décomposition des dimensions
Autonomie décisionnelle 14 / 20
Accès aux outils & APIs 15 / 20
Privilege 12 / 15
Persistence 10 / 15
External Impact 14 / 15
Propagation 12 / 15
⚖️ Divergence & Justification opérationnelle

Défaillance de sécurité agentique classifiée sous le motif AAP-006 (Context Boundary Collapse / Multimodal Ingress Leak). La vulnérabilité brise la frontière de confiance entre le raisonnement du modèle et le système d'exploitation sous-jacent.

🕸️ Graphe de connaissances connecté & Provenance

CVE-2026-54236: vLLM Multimodal Image Processing Unhandled Exception Memory Pointer DisclosureVULNÉRABILITÉ

Nœuds connectés : 2
Relations sortantes actives
→ affectsCOMPOSANTvLLM Inference Engine
98% VERY_HIGH

Software platform affected by security vulnerabilities and agentic attack patterns.

🔍 Pourquoi cette relation ? (Preuves & Provenance)

“Confirmed security vulnerability in vLLM Inference Engine documented in Hermes dossier.”

Preuves vérifiées associées :
92% VERY_HIGH

Exploitation of unauthenticated, unsigned inter-agent communication channels to forge delegation directives, impersonate orchestrator agents, and command worker subagents.

🔍 Pourquoi cette relation ? (Preuves & Provenance)

“CVE-2026-54236 weaponizes the agentic attack pattern formalized under AAP-006.”

Preuves vérifiées associées :

vLLM Inference Engine est largement déployé au sein des architectures de production pour orchestrer des modèles de langage, des pipelines de données et des agents autonomes. CVE-2026-54236 constitue une menace directe pour l’intégrité de l’infrastructure :

ParamètreSpécification TechniqueRapprochement Opérationnel
Identifiant CVECVE-2026-54236Référencé dans le graphe de connaissances Hermes
Produit affectévLLM Inference EnginevLLM Project
Composant vulnérablevLLM Multimodal Image Decoder & Anthropic Router StreamSas de validation et d’exécution
Vecteur d’attaqueRéseau / Contexte local non fiableCVSS:3.1/AV:N/AC:L/PR:N/UI:N/S:U/C:L/I:N/A:N
Statut CISA KEVSurveillé / Fort potentiel d’armementPriorisation d’application d’urgence
Techniques MITRE ATT&CKT1082 (System Information Discovery), T1499 (Endpoint DoS)Matrice MITRE ATT&CK
Motif d’attaque agentiqueAAP-006 (Context Boundary Collapse / Multimodal Ingress Leak)Référentiel des risques agentiques Hermes

2. Analyse de cause racine & mécanismes d’exécution

Section intitulée « 2. Analyse de cause racine & mécanismes d’exécution »

La faille découle d’un défaut de validation des entrées et d’une absence d’isolation du processus au sein de vLLM Multimodal Image Decoder & Anthropic Router Stream :

[ Charge utile hostile / Entrée non filtrée ]
│
▼
[ Point d'accès : vLLM Multimodal Image Decoder & Anthropic Router Stream ]
│ (Défaut de validation canonique / Évaluation dangereuse)
▼
[ Couche d'exécution : Processus hôte / Shell système ]
│
▼
[ Impact : Exécution de code arbitraire / Exfiltration de secrets ]

Lors de la réception des requêtes, le code applicatif omettait d’imposer des listes blanches strictes ou une résolution canonique des chemins, permettant l’exécution directe de code ou des accès fichiers arbitraires.


3. Scénario d’exploitation & cinématique d’attaque

Section intitulée « 3. Scénario d’exploitation & cinématique d’attaque »

Pour neutraliser efficacement CVE-2026-54236, les équipes de défense doivent appréhender la cinématique opératoire des assaillants :

  1. Reconnaissance & découverte : les cyberattaquants identifient les instances exposées via des empreintes de bannières ou des moteurs de recherche d’actifs internet.
  2. Transmission de la charge : une requête forgée contenant la charge d’exploitation est envoyée vers vLLM Multimodal Image Decoder & Anthropic Router Stream.
  3. Évasion & exécution : le serveur évalue la charge avec les droits du processus hôte, s’affranchissant du bac à sable applicatif.
  4. Post-exploitation : l’attaquant extrait les clés d’API LLM maîtresses, installe une persistance ou pivote vers l’infrastructure cloud connectée.

Les équipes de détection et SOC peuvent déployer les règles de surveillance suivantes :

title: Exécution Suspecte depuis un Processus vLLM Inference Engine (CVE-2026-54236)
status: experimental
description: Détecte l'exécution anormale d'interpréteurs de commande ou d'outils réseau depuis vLLM Inference Engine
references:
- https://codex.hermes-cyber.com/fr/cve/2026/cve-2026-54236/
author: Hermes Cyber Intelligence
logsource:
category: process_creation
product: linux
detection:
selection:
ParentImage|endswith:
- '/python'
- '/node'
- '/langflow'
- '/flowise'
Image|endswith:
- '/sh'
- '/bash'
- '/curl'
- '/wget'
condition: selection
falsepositives:
- Scripts d'administration légitimes
level: high

Pour éliminer le risque lié à CVE-2026-54236 :

  1. Mise à jour immédiate : migrez sans délai vers la version vLLM 0.23.1rc0 ou supérieure.
  2. Cloisonnement réseau : restreignez l’accès aux interfaces d’administration via un réseau privé virtuel (VPN) ou une passerelle ZTNA.
  3. Confinement en conteneur : exécutez les conteneurs avec un utilisateur sans privilèges, un système de fichiers en lecture seule et des profils seccomp stricts.
  4. Renouvellement des secrets : révoquez et régénérez l’ensemble des clés d’API des fournisseurs LLM et identifiants de bases de données accessibles par l’application.