Sécurité IA7 min de lecture
Pourquoi un agent IA ne devrait jamais avoir un accès illimité
En brefUn agent IA qui peut tout faire est un point de défaillance unique : une erreur de raisonnement ou une instruction malveillante se transforme directement en action réelle. La sécurité d’un agent se construit avec des permissions minimales, une validation humaine sur les actions sensibles et un journal d’audit complet.
Le risque d’un accès illimité
Donner à un agent IA un accès complet à une boîte email, un CRM ou une base de données revient à donner les clés du système à un processus qui peut se tromper, halluciner un fait, ou être manipulé par une instruction cachée dans un document qu’il lit.
Le problème n’est pas la compétence du modèle, mais l’absence de garde-fou entre son raisonnement et l’exécution réelle.
Permissions minimales par agent
Chaque agent devrait avoir un périmètre d’outils explicite, propre à sa mission. Un agent de prospection n’a pas besoin d’accès aux données financières ; un agent d’analyse de fichiers n’a pas besoin d’envoyer des emails.
Ce principe, connu sous le nom de moindre privilège, réduit mécaniquement l’impact d’une erreur ou d’une compromission.
Policy Engine et approbations humaines
Un Policy Engine classe les actions par niveau de risque : lecture seule, écriture interne, action externe (email, paiement, publication). Les actions à risque élevé restent bloquées jusqu’à une approbation humaine explicite.
C’est la différence entre un agent qui propose et un agent qui décide seul. Le premier reste sous contrôle, le second devient un risque non maîtrisé.
Journal d’audit
Chaque exécution devrait pouvoir répondre à : qui a demandé, quel agent a agi, avec quel outil, pour quel résultat. Sans ce journal, une erreur devient impossible à diagnostiquer après coup.
Questions fréquentes
Le sandboxing suffit-il à sécuriser un agent IA ?
Non, seul. Le sandbox limite l’exécution technique, mais doit être combiné à des permissions minimales, une validation humaine sur les actions sensibles et un audit complet pour couvrir le risque de bout en bout.
Comment savoir quelles actions doivent exiger une approbation humaine ?
Comme règle générale : toute action externe irréversible (envoi d’email, paiement, publication, suppression de données) doit passer par une approbation explicite, indépendamment de la confiance accordée au modèle.