Aller au contenu principal
Expert Cybersécurité & IAv9.0
Centres de ressources conformité
Besoin d'un accompagnement expert ?
Devis personnalisé sous 24h — audit, conformité, incident
Checklists Sécurité — Audit & Durcissement
Formats disponibles
📄 PDF 📊 Excel 🌐 Web

11 checklists professionnelles couvrant 2 200+ points de contrôle. Téléchargement gratuit, aucune inscription.

Detournement d'agent autonome

ia

Définition

Le detournement d'agent autonome designe la manipulation d'un agent IA pour lui faire executer des actions non prevues par son operateur, en exploitant sa capacite a planifier et a agir de maniere independante. Contrairement a une simple injection de prompt qui vise une reponse textuelle, le detournement cible le cycle de decision de l'agent : ses objectifs, sa memoire, ses appels d'outils ou ses interactions avec d'autres agents. L'attaquant insere des instructions malveillantes via un document consulte, une page web parcourue, un email traite ou une reponse d'un autre agent dans un systeme multi-agents, provoquant une derive des objectifs (goal hijacking). Les consequences vont de l'exfiltration de donnees sensibles a l'execution de transactions frauduleuses, en passant par la propagation laterale dans un environnement connecte a des systemes d'information critiques. Ce risque est amplifie par l'octroi de permissions larges aux agents, la memoire persistante entre sessions et l'absence de verification humaine sur chaque etape. Les cadres comme MITRE ATLAS et l'OWASP Agentic AI documentent ces scenarios. Les contre-mesures principales sont la segmentation des privileges par tache, la validation humaine des actions sensibles (human-in-the-loop), le confinement des sources d'entree non fiables et la surveillance comportementale des chaines d'actions de l'agent.

Articles liés

Un projet cybersécurité ?

Expert dispo · Réponse 24h

Devis