autorisation déterministe backend par outil (allowlist, validation indépendante du modèle, portée des tokens, gates d'approbation), révision individuelle de chaque outil d'écriture et d'escalade.
La menace
le modèle déclenche une action externe non autorisée en la demandant à travers un outil (tool hijacking, écriture non autorisée, abus de workflow, escalade de privilège) ou à travers un agent.
Angle mortPourquoi les grilles classiques la ratent
le risque n'est pas ce qu'on dit au système mais ce qu'on lui donne les moyens de faire ; un « agent » ne rentre dans aucune catégorie classique d'exposition.
MitigationSolution proposée
autorisation déterministe backend par outil (allowlist, validation indépendante du modèle, portée des tokens, gates d'approbation), révision individuelle de chaque outil d'écriture et d'escalade.
Le contrôle proposé
une demande articulée au modèle ne produit une action que si un backend déterministe l'autorise.
Preuve attendue
démontrer qu'une demande articulée au modèle ne produit une action que si un backend déterministe l'autorise.