tests adversariaux du scoring (camouflage d'une attaque en signaux bénins), rôle du human-in-the-loop sur les cas limites, traçage des signaux entrants.
La menace
le moteur de risque sous-cote une attaque (faux négatif), sur-cote un appel légitime (faux positif) ou fusionne mal des signaux d'attaque fragmentés, laissant passer une action malveillante.
Angle mortPourquoi les grilles classiques la ratent
le scoring est souvent traité comme une boîte fiable ; sa défaillance (faille de fusion, seuils) est un vecteur d'élévation silencieux que personne ne teste en adversarial.
MitigationSolution proposée
tests adversariaux du scoring (camouflage d'une attaque en signaux bénins), rôle du human-in-the-loop sur les cas limites, traçage des signaux entrants.
Le contrôle proposé
aucune action sensible passée sur le seul score sans traçage des signaux.
Preuve attendue
une campagne fragmentée ne passe pas le moteur de risque sans alerte.