Banana Navy
Catalogue EN
Lab · Threat modeling IA · Fiche détaillée

Défaillance du scoring (faux négatifs, signaux fragmentés)

le moteur de risque sous-cote une attaque (faux négatif), sur-cote un appel légitime (faux positif) ou fusionne mal des signaux d'attaque fragmentés, laissant passer une action malveillante.

FicheF14
Catégorieborne du moteur de risque (angle mort méthodologique)
Couches13 · Risk Scoring
Systèmevoicebot IA

tests adversariaux du scoring (camouflage d'une attaque en signaux bénins), rôle du human-in-the-loop sur les cas limites, traçage des signaux entrants.

La menace

le moteur de risque sous-cote une attaque (faux négatif), sur-cote un appel légitime (faux positif) ou fusionne mal des signaux d'attaque fragmentés, laissant passer une action malveillante.

Angle mortPourquoi les grilles classiques la ratent

le scoring est souvent traité comme une boîte fiable ; sa défaillance (faille de fusion, seuils) est un vecteur d'élévation silencieux que personne ne teste en adversarial.

MitigationSolution proposée

tests adversariaux du scoring (camouflage d'une attaque en signaux bénins), rôle du human-in-the-loop sur les cas limites, traçage des signaux entrants.

Le contrôle proposé
aucune action sensible passée sur le seul score sans traçage des signaux.

Preuve attendue
une campagne fragmentée ne passe pas le moteur de risque sans alerte.

SourcesRéférences et recherche publique

Recherche publiqueSources de recherche publiques : MITRE ATLAS 2026.07 (mapping technique vérifié), OWASP GenAI (catégories par abus de modèle), et le gabarit public risk-voicebot (aivansoul/risk-voicebot) qui définit les 20 checkpoints. Aucune donnée de registre client : fiche générique, sans cote ni verdict.
couche 13 · Risk Scoring

Lire les 20 couches de sécurité

MITRE ATLAS 2026.07 · OWASP GenAI · risk-voicebot