Banana Navy
Catalogue EN
Lab · Threat modeling IA · Fiche détaillée

Abus d'outil, d'agent et de workflow

le modèle déclenche une action externe non autorisée en la demandant à travers un outil (tool hijacking, écriture non autorisée, abus de workflow, escalade de privilège) ou à travers un agent.

FicheF20
CatégorieAI6-TB7 (tool / agent abuse)
Couches10 · Prompt Injection Filter, 14 · LLM Interpretation, 15 · Policy Engine, 16 · Workflow Execution
Systèmevoicebot IA

autorisation déterministe backend par outil (allowlist, validation indépendante du modèle, portée des tokens, gates d'approbation), révision individuelle de chaque outil d'écriture et d'escalade.

La menace

le modèle déclenche une action externe non autorisée en la demandant à travers un outil (tool hijacking, écriture non autorisée, abus de workflow, escalade de privilège) ou à travers un agent.

Angle mortPourquoi les grilles classiques la ratent

le risque n'est pas ce qu'on dit au système mais ce qu'on lui donne les moyens de faire ; un « agent » ne rentre dans aucune catégorie classique d'exposition.

MitigationSolution proposée

autorisation déterministe backend par outil (allowlist, validation indépendante du modèle, portée des tokens, gates d'approbation), révision individuelle de chaque outil d'écriture et d'escalade.

Le contrôle proposé
une demande articulée au modèle ne produit une action que si un backend déterministe l'autorise.

Preuve attendue
démontrer qu'une demande articulée au modèle ne produit une action que si un backend déterministe l'autorise.

SourcesRéférences et recherche publique

MITRE ATLAS 2026.07AML.T0053 AI Agent Tool Invocation
OWASP GenAIOWASP GenAI LLM06:2025 Excessive Agency
Recherche publiqueSources de recherche publiques : MITRE ATLAS 2026.07 (mapping technique vérifié), OWASP GenAI (OWASP), et le gabarit public risk-voicebot (aivansoul/risk-voicebot) qui définit les 20 checkpoints. Aucune donnée de registre client : fiche générique, sans cote ni verdict.
couche 10 · Prompt Injection Filtercouche 14 · LLM Interpretationcouche 15 · Policy Enginecouche 16 · Workflow Execution

Lire les 20 couches de sécurité

MITRE ATLAS 2026.07 · OWASP GenAI · risk-voicebot