B2Shift · Publié le 27 août 2026 · Mis à jour le 27 août 2026
Un agent IA capable d'effectuer des actions (et pas seulement de générer du texte) hérite des exigences de sécurité de tout ce à quoi il est connecté, ainsi que de quelques-unes qui lui sont propres. La plupart des incidents sont dus à un accès trop large et non au modèle lui-même.
L'accès avec le moindre privilège est le contrôle qui compte le plus
Un agent doit détenir sa propre identité et ses propres autorisations étendues, jamais les informations d'identification empruntées par un administrateur. Accordez uniquement les systèmes et les champs requis par la tâche spécifique. L'élargissement de l'accès ultérieurement est un changement de configuration ; découvrir qu'un agent avait un accès inutile après un an d'exécution est un problème d'audit, pas une solution miracle.
Divisez les actions en fonction de leur réversibilité, et non en fonction de leur impression.
La lecture, la rédaction, la classification et le routage peuvent généralement s'effectuer sans surveillance. Envoyer de l’argent, publier un prix, répondre à une plainte sous votre nom ou supprimer un enregistrement méritent une porte d’approbation humaine – ou au minimum une fenêtre de délai pendant laquelle une personne peut intervenir. Traiter chaque action de la même manière, soit sur-restreint les cas utiles, soit sous-restreint les cas dangereux.
Surveiller la dérive, pas seulement la disponibilité
Un agent peut être techniquement en ligne et se tromper discrètement : répondre avec des connaissances obsolètes, classer mal une part croissante de demandes ou dériver hors de son champ d'action prévu à mesure que les systèmes en amont changent. Le suivi doit suivre les tendances en matière de qualité des résultats et de confiance, et pas seulement la réponse du service.
Rendre chaque décision reconstructible
Chaque action doit enregistrer ce qui l'a déclenchée, le contexte qu'elle a utilisé, ce qu'elle a décidé, sa confiance, si un humain l'a approuvée et ce qui a changé en conséquence. Le Top 10 OWASP pour les applications LLM documente les classes d'échec courantes (agence excessive, gestion des sorties non sécurisée, injection rapide) qui valent la peine de vérifier votre conception avant le lancement.
La gestion de la confiance est un chemin conçu, pas une réflexion après coup
Les cas à faible confiance doivent avoir une destination explicite : une personne nommée ou une file d'attente de révision, jamais une meilleure hypothèse silencieuse. Le mode d'échec que vous souhaitez est « cela est allé à un humain » ; celui contre lequel vous concevez est "cela s'est mal passé et personne ne l'a remarqué pendant trois semaines". Voir Agents IA / Employés IA pour savoir comment cela est intégré dans une version, et Comment assurer la sécurité de l'automatisation de l'IA et la prise en compte du RGPD pour la moitié de la protection des données de cette image.
Discuter de votre flux