Modèle de confiance et gestion des preuves de Hermes
1. La hiérarchie épistémique : fait vs inférence vs prédiction
Section intitulée « 1. La hiérarchie épistémique : fait vs inférence vs prédiction »En analyse de cybermenaces, la frontière entre observation terrain et conjecture analytique est trop souvent brouillée. Hermes formalise quatre niveaux stricts :
┌─────────────────────────────────────────────────────────────────────────┐│ 1. FAIT ││ Donnée primaire directement observable et vérifiée à la source. ││ Exemple : "Un commit corrigeant CVE-2026-41264 a été mergé." │├─────────────────────────────────────────────────────────────────────────┤│ 2. INFÉRENCE ││ Déduction logique issue de l'analyse des faits techniques. ││ Exemple : "Le patch ajoutant une validation AST confirme que la ││ faille provenait d'une exécution Python non sandbxée." │├─────────────────────────────────────────────────────────────────────────┤│ 3. PRÉDICTION ││ Projection probabiliste du comportement futur des attaquants. ││ Exemple : "Hermes estime à 82 % la probabilité d'une intégration ││ dans des scanners automatisés sous 72 heures." │├─────────────────────────────────────────────────────────────────────────┤│ 4. HYPOTHÈSE ││ Modèle de travail sujet à falsification continue. ││ Exemple : "La campagne pourrait être affiliée à Storm-1175 en ││ raison de stagers PowerShell partagés." │└─────────────────────────────────────────────────────────────────────────┘2. Calcul mathématique de l’indice de confiance
Section intitulée « 2. Calcul mathématique de l’indice de confiance »Tout score et toute conclusion publiés par Hermes Codex sont assortis d’un Indice de Confiance ($C \in [0.0, 1.0]$) calculé à partir de données objectives :
Confiance (C) = min(1.0, max(0.1, QualitéBase + Somme(BonusSources) - PénalitéContradiction - DistanceInférence))Paramètres de calcul :
Section intitulée « Paramètres de calcul : »- Poids de fiabilité de la source ($w_s \in [0.1, 0.35]$) :
- Avis officiel de l’éditeur, CERTs, CISA KEV :
0.35 - Laboratoire de recherche reconnu / Dépôt de PoC vérifié :
0.25 - Scanners automatisés et agrégateurs :
0.15 - Messages sur réseaux sociaux / forums non vérifiés :
0.05
- Avis officiel de l’éditeur, CERTs, CISA KEV :
- Bonus de corroboration multi-sources ($+0.10$ par source indépendante, max $+0.30$) :
- La concordance de $\ge 3$ sources distinctes assure un niveau de confiance élevé.
- Validation technique en laboratoire ($+0.25$) :
- Attribué si le PoC ou le mécanisme d’attaque a été rejoué avec succès dans le lab confiné Hermes.
- Pénalité de contradiction ($-0.35$) :
- Déclenchée si des sources primaires s’opposent sur la cause racine, l’impact ou l’exploitation active.
- Distance d’inférence ($-0.10$ par saut déductif) :
- Pénalise les conclusions reposant sur une chaîne d’hypothèses sans trace télémétrique directe.
3. Niveaux de classification de la confiance
Section intitulée « 3. Niveaux de classification de la confiance »| Indice de Confiance | Qualification | Seuil de Publication | Action Opérationnelle |
|---|---|---|---|
| 0.90 – 1.00 | TRÈS ÉLEVÉE | Publication Automatisée | Renseignement immédiatement exploitable ; recommandation de remédiation d’urgence. |
| 0.75 – 0.89 | ÉLEVÉE | Publication Automatisée | Rapport d’intelligence standard avec citations télémétriques vérifiées. |
| 0.55 – 0.74 | MOYENNE | Passage Critique Exigé | Publié avec mention explicite des vérifications en cours. |
| 0.35 – 0.54 | FAIBLE | Rétention pour Preuves | Conservé en interne ; exclu des tableaux de bord principaux. |
| 0.00 – 0.34 | TRÈS FAIBLE | Rejet | Considéré comme une rumeur non étayée ou une hallucination. |
4. Gestion des désaccords entre sources
Section intitulée « 4. Gestion des désaccords entre sources »Lorsque les sources d’intelligence s’opposent, Hermes Codex ne force jamais un consensus artificiel. Le désaccord est documenté publiquement :
┌─────────────────────────────────────────────────────────────┐│ ⚠️ DÉSACCORD DE RENSEIGNEMENT IDENTIFIÉ ││ ││ Source A (Avis Éditeur) : "CVSS 7.2 — Interaction ││ Utilisateur requise ; aucun vecteur distant sans terminal." ││ ││ Source B (Recherche Pillar Security) : "CVSS 8.8 / HASS 91 —││ Le mode Auto-Run exécute les commandes sans confirmation." ││ ││ Résolution Hermes : ││ Hermes retient la vérification technique du lab (B) car le ││ mode Auto-Run court-circuite toute validation à l'exécution.││ Indice de confiance ajusté à 88 % en raison du litige. │└─────────────────────────────────────────────────────────────┘Cette transparence empêche les dérives d’interprétation et garantit l’intégrité de la plateforme.
5. Méthodologies liées
Section intitulée « 5. Méthodologies liées » Score de Sécurité Agentique (HASS) Métrique quantitative évaluant le risque systémique des agents IA autonomes.
Score de Menace Opérationnelle (HTS) Métrique évaluant l'exploitabilité réelle et l'urgence de correction.