Aller au contenu

Rayon d'impact agentique : simulateur de dégâts cinétiques & banc de confinement


Simulez la propagation multi-sauts d’une brèche, examinez la matrice de dégâts à 5 vecteurs, consultez les profils d’incidents vérifiés ou calculez le score de rayon d’impact (BRS) de votre infrastructure dans le bac d’essai côté client :

5 Vecteurs de Dégâts Hôte, Data, IAM, Coût, Cascade
-75.5% Atténuation MicroVM Moyenne Réduction prouvée du rayon
4 Sauts Max de Propagation Escalade inter-agents
100% Confidentialité Client (P7) Zéro transmission serveur

Topologie de Propagation Multi-Sauts d'une Brèche Agentique

Contrairement à un logiciel conventionnel confiné à un processus statique, la compromission d'un agent autonome traverse la mémoire RAG, les jetons IAM ambiants et les outils connectés pour contaminer en cascade l'ensemble du maillage d'entreprise.

Hop 01

Perception & Injection Initiale

Injection indirecte via document RAG, page web aspirée ou invite hostile de l'utilisateur.

Vecteur d'entrée Contournement Prompt Système
→
Hop 02

Raisonnement & Détournement d'Outil

Le modèle subverti paramètre les outils avec des arguments arbitraires (commandes shell, requêtes API).

Actionnement d'Outil Exécution de Shell / REPL
→
Hop 03

Pillage IAM & Échappement Hôte

Extraction des jetons de service cloud (AWS IMDS, GitHub PAT) et persistance sur le système de fichiers.

Rebond Latéral Élévation de Privilèges
→
Hop 04

Cascade d'Essaim & Impact Cinétique

Ordres hostiles relayés aux agents pairs via le protocole MCP, déclenchant des pipelines de production.

Rayon d'Impact Terminal Compromission d'Entreprise

Matrice d'Évaluation du Rayon d'Impact à 5 Vecteurs

Le score de Rayon d'Impact (Blast Radius Score — BRS) quantifie de 0 à 100 les dommages cinétiques sur 5 dimensions orthogonales pondérées.

host_infrastructure 25% Poids

Host & Infrastructure Reach

Depth of host OS compromise, local filesystem access, shell execution, Docker socket tampering, and hypervisor escape potential.

Impact de Sévérité Maximale : Host takeover, container breakout, kernel rootkit persistence.
data_rag 25% Poids

Data & Memory Blast

Exposure, exfiltration, or adversarial poisoning of vector databases, enterprise knowledge bases, user conversations, and sensitive files.

Impact de Sévérité Maximale : Persistent RAG poisoning, corporate secret leakage, cross-session sleeper payloads.
identity_iam 20% Poids

Identity & Credential Scope

Blast perimeter of credentials accessible to the agent: cloud IAM roles, OAuth tokens, SSH keys, API secrets, and inter-service authentication.

Impact de Sévérité Maximale : Cloud tenant pivot, unauthorized database access, automated lateral movement.
financial_spend 15% Poids

Financial & Operational Burn

Financial damage caused by runaway autonomous loops, unconstrained API token consumption, third-party service fees, or Denial of Wallet.

Impact de Sévérité Maximale : Budget exhaustion, upstream API rate lockout, unexpected cloud billing spikes.
cascade_propagation 15% Poids

Downstream Cascade Propagation

Propagation multiplier when compromised agent communicates with peer agents in a swarm, triggering downstream trusted actuators without re-validation.

Impact de Sévérité Maximale : Swarm-wide subversion, automated production deployments, cascading system destabilization.

Facteurs d'Atténuation des Frontières de Confinement (Ω_containment)

Modèle d'Isolation Facteur d'Isolation Atténuation du Rayon d'Impact Mécanisme de Sécurité
Ephemeral MicroVM (Firecracker / Kata) 0.15 -85% Disposable virtual machine booted in <10ms with hardware-assisted hypervisor isolation, read-only rootfs, and dropped host network.
Application-Level Sandbox (gVisor / seccomp / AppArmor) 0.35 -65% Intercepted system calls via user-space kernel proxy with strict capabilities stripping and limited temporary filesystem.
Standard Container (Docker / Podman Default) 0.65 -35% Standard Linux namespaces and cgroups without custom seccomp profiles; vulnerable to Docker socket exposure and shared kernel escapes.
Unsandboxed Host Process 1.00 -0% Agent execution directly on developer workstation or server host OS; direct access to filesystem, local network, and environment variables.

Profils de Rayon d'Impact d'Incidents Réels Vérifiés

Comparaison entre le rayon d'impact brut non confiné (processus nu sur l'hôte) et le rayon résiduel contenu sous isolation MicroVM.

BLAST-2026-001 LangChain / Langflow
CVE-2026-27966 →

Langflow CSV Agent Unconstrained REPL Breakout

Score Brut Non Confiné 94.0
-75.5 avec MicroVM
Score Résiduel Isolé 18.5
Décomposition par Vecteur (Score Brut) :
Host:
95
Data:
80
IAM:
92
Cost:
40
Cascade:
88
Chaîne d'Attaque Multi-Sauts :
  1. Adversarial CSV uploaded to conversational agent
  2. Pandas query generation poisoned with exec() payload
  3. Local Python REPL executes arbitrary shell command as host UID 1000
  4. AWS instance metadata service (IMDSv1) queried via curl
  5. Temporary IAM role credentials exfiltrated to adversary C2
BLAST-2026-002 Model Context Protocol (MCP)
AAP-004 →

MCP Untrusted Community Tool Protocol Hijacking

Score Brut Non Confiné 88.0
-74.0 avec MicroVM
Score Résiduel Isolé 14.0
Décomposition par Vecteur (Score Brut) :
Host:
85
Data:
90
IAM:
94
Cost:
25
Cascade:
70
Chaîne d'Attaque Multi-Sauts :
  1. User connects third-party community MCP server for weather lookup
  2. Tool definition injects shadow tool 'system_diagnostics' with broad regex match
  3. Agent routes sensitive file reading task to shadow MCP server
  4. Local SSH private keys (~/.ssh/id_ed25519) and .env secrets read via stdio
  5. Secrets dispatched via outbound DNS tunneling subquery
BLAST-2026-003 Cursor AI IDE
CVE-2026-22708 →

Cursor IDE Agent Workspace Token Harvest & Command Chaining

Score Brut Non Confiné 91.5
-75.5 avec MicroVM
Score Résiduel Isolé 16.0
Décomposition par Vecteur (Score Brut) :
Host:
90
Data:
85
IAM:
95
Cost:
30
Cascade:
75
Chaîne d'Attaque Multi-Sauts :
  1. Developer opens open-source repo with hidden instructions in README.md
  2. Agent scans workspace during contextual indexing
  3. Hidden instruction commands agent to run background build script
  4. Subshell executes curl fetching remote obfuscated payload
  5. GitHub Personal Access Token (.git-credentials) exfiltrated to attacker server
BLAST-2026-004 CrewAI / Multi-Agent Swarms
AAP-006 →

CrewAI Multi-Agent Swarm Lateral Trust Impersonation

Score Brut Non Confiné 86.0
-64.0 avec MicroVM
Score Résiduel Isolé 22.0
Décomposition par Vecteur (Score Brut) :
Host:
75
Data:
88
IAM:
82
Cost:
60
Cascade:
95
Chaîne d'Attaque Multi-Sauts :
  1. Adversary inserts poisoned research abstract into enterprise vector DB
  2. Research Agent retrieves poisoned chunk during automated briefing task
  3. Research Agent synthesizes false security directive to Executive Agent
  4. Executive Agent trusts peer agent output without out-of-band verification
  5. Executive Agent triggers production deployment pipeline webhook deploying rogue image
BLAST-2026-005 Microsoft AutoGen
AAP-007 →

AutoGen Unbounded Recursive Loop & Cloud API Spend Burn

Score Brut Non Confiné 78.0
-70.0 avec MicroVM
Score Résiduel Isolé 8.0
Décomposition par Vecteur (Score Brut) :
Host:
30
Data:
40
IAM:
35
Cost:
98
Cascade:
65
Chaîne d'Attaque Multi-Sauts :
  1. External customer query introduces paradoxical goal logic
  2. Two peer agents enter infinite refinement and validation dialogue
  3. Agent tools continuously spawn external API calls and cloud function executions
  4. No circuit breaker or financial rate-limiter halts the autonomous iteration
  5. 14,000 API calls executed in 2 hours costing $4,800 and exhausting rate quotas
BLAST-2026-006 OpenDevin / All-Hands AI
CVE-2026-76461 →

OpenDevin Container Breakout & Host Docker Socket Compromise

Score Brut Non Confiné 96.0
-84.0 avec MicroVM
Score Résiduel Isolé 12.0
Décomposition par Vecteur (Score Brut) :
Host:
99
Data:
85
IAM:
90
Cost:
45
Cascade:
92
Chaîne d'Attaque Multi-Sauts :
  1. Agent instructed to debug Docker configuration file
  2. Prompt injection tricks model into mounting host /var/run/docker.sock
  3. Agent issues container command spawning privileged container with host root / mount
  4. Host filesystem accessed and persistence installed in /etc/cron.d/
  5. Full root host takeover bypassing container sandbox

Simulateur Interactif de Rayon d'Impact Agentique (P7)

Configurez les paramètres architecturaux de votre déploiement d'agent pour évaluer instantanément son potentiel de destruction cinétique, son score BRS et obtenir votre plan de confinement sur mesure.

SCORE DE RAYON D'IMPACT ESTIMÉ 🔒 Client-Side P7
38.4 / 100
MODERATE BLAST

Rayon d'impact circonscrit mais risque d'exfiltration de données via les canaux réseau sortants.

Hôte & Infra :
45%
Données & RAG :
60%
Identité & IAM :
50%
Coût & Emballement :
35%
Propagation Essaim :
40%

📋 Mesures Prioritaires de Confinement du Rayon :

  • Isolation MicroVM : Déployer Firecracker pour ramener le facteur d'isolation de l'hôte à 0.15.
  • Éphémérité IAM : Réduire la durée de vie des jetons STS à moins de 60 secondes avec portance sur ARN unique.
  • Coupe-Circuit Financier : Imposer un plafond matériel de 10 tours autonomes et 5.00$ de jetons par exécution.

1. Décomposition des 5 vecteurs de destruction agentique

Section intitulée « 1. Décomposition des 5 vecteurs de destruction agentique »

Lorsqu’un agent autonome est détourné via une injection indirecte de prompt ou un empoisonnement d’outil, les dégâts ne restent pas confinés à son processus local. Hermes évalue l’onde de choc selon 5 dimensions orthogonales :

graph TD
Compromise["Compromission de l'Agent (AAP-001 / AAP-002)"] --> V1["1. Hôte & Infrastructure (B_host)"]
Compromise --> V2["2. Mémoire & Données RAG (B_data)"]
Compromise --> V3["3. Identité & Secrets IAM (B_iam)"]
Compromise --> V4["4. Coût & Emballement (B_cost)"]
Compromise --> V5["5. Cascade d'Essaim Aval (B_cascade)"]
V1 --> Impact1["Évasion de Noyau / RCE Hôte"]
V2 --> Impact2["Empoisonnement RAG Persistant"]
V3 --> Impact3["Rebond sur le Tenant Cloud"]
V4 --> Impact4["Épuisement Budgétaire Brutal"]
V5 --> Impact5["Subversion Totale de l'Essaim"]
  1. Portée hôte & infrastructure (B_host — poids 25%) : quantifie la capacité de l’agent à interagir avec le système de fichiers hôte, exécuter des sous-shells, manipuler le socket Docker ou s’évader d’un conteneur.
  2. Rayon mémoire & données (B_data — poids 25%) : mesure l’exposition et la contamination potentielle des bases vectorielles d’entreprise (RAG), des espaces documentaires et de la mémoire épisodique.
  3. Périmètre d’identité & secrets IAM (B_iam — poids 20%) : évalue les identifiants accessibles à l’agent. Des clés d’API statiques de longue durée ou des rôles IAM trop permissifs permettent à l’attaquant de rebondir sur les tenants cloud et plateformes SaaS.
  4. Emballement financier & opérationnel (B_cost — poids 15%) : mesure les préjudices financiers résultant de boucles de raisonnement non bornées, d’appels massifs d’APIs payantes et d’attaques par déni de portefeuille.
  5. Propagation en cascade d’essaim (B_cascade — poids 15%) : mesure la facilité avec laquelle un agent spécialiste compromis peut transmettre des ordres malveillants à ses pairs, déclenchant des actions critiques sans validation humaine intermédiaire.

2. Atténuation par confinement : le paradigme des MicroVMs

Section intitulée « 2. Atténuation par confinement : le paradigme des MicroVMs »

L’apport fondamental du Modèle de Rayon d’Impact Hermes (HBRM) réside dans l’atténuation multiplicative apportée par le confinement matériel :

BRS = min(100, RawComposite * Omega_containment)

Où Omega_containment représente le facteur d’atténuation de la frontière d’isolation :

  • Processus hôte nu (Omega = 1.00) : aucune atténuation. L’échappement de commande confère une prise de contrôle totale de la machine hôte.
  • Conteneur Docker standard (Omega = 0.65) : atténuation modérée, mais vulnérable au noyau Linux partagé, aux montages de sockets et aux pivots réseau locaux.
  • Sandbox applicatif (gVisor / seccomp — Omega = 0.35) : forte atténuation via l’interception des appels système et la suppression des capacités Linux.
  • MicroVM éphémère (Firecracker / Kata — Omega = 0.15) : isolation par virtualisation matérielle. Détruite immédiatement après la fin de la tâche, diminuant de plus de 80% les dégâts réels.

Conformément au principe Hermes P6 (Machine-Readable First), toutes les données de modélisation du rayon d’impact sont accessibles via des endpoints REST statiques :