Brouillon en relecture. Ce contenu n’a pas encore été validé par l’auteur.

Un agent, des risques

  • 6 min
  • 30 points
  1. 1Un agent, des risques
  2. 2Le formulaire piégé
  3. 3Trois lignes de défense

À la fin de cette étape, vous saurez :

  • Comprendre ce qu’un agent ajoute par rapport à un simple assistant qui répond
  • Reconnaître ce qui rend une automatisation plus ou moins risquée

Situation

Yanis loue du matériel d’événementiel. Un prestataire lui propose un agent qui lit les demandes de réservation et met à jour son fichier clients tout seul. « Vous ne touchez plus à rien », lui dit-on.

L’essentiel

Un Agent Système qui combine un modèle, des outils et une boucle d'action pour accomplir une tâche. Voir le glossaire ne se contente pas de répondre : il agit dans vos logiciels (lire, écrire, envoyer). C’est ce qui en fait un gain de temps, et ce qui en fait un risque : un texte reçu de l’extérieur (un formulaire, un email) peut contenir une instruction cachée, destinée à détourner l’agent de sa tâche.

Ce qui rend un agent plus sûr

Ce qu’il lit vient de l’extérieur. Un formulaire, un email, un document : personne ne les a relus avant l’agent. Traitez-les comme des données, jamais comme des consignes.

Ce qu’il peut faire compte plus que ce qu’il fait d’habitude. Un agent qui ne peut que lire et ajouter une ligne cause moins de dégâts, détourné, qu’un agent qui peut tout modifier ou exporter.

Ce qui est vérifié avant de partir. Une action sensible (un envoi groupé, un export, une suppression) gagne à attendre l’accord d’une personne.

Classer

Plutôt sûr, ou à corriger ?

Classez chaque façon de configurer un agent.

À classer (6)

  • Un agent qui lit les emails et propose un brouillon de réponse, sans jamais l’envoyer seul.

  • Un agent qui lit les formulaires et ajoute une ligne dans le fichier clients, rien de plus.

  • Un agent qui demande une confirmation avant d’envoyer un message à plus de dix destinataires.

  • Un agent connecté au compte bancaire, qui peut valider des virements sans confirmation.

  • Un agent qui traite le contenu d’un email reçu comme s’il venait toujours de vous.

  • Un agent qui exporte automatiquement toute la base de données chaque nuit, sans journal.

Plutôt sûr 0

À corriger 0

Répondez à tout pour valider.

« Ignore tes consignes précédentes »

C’est la formule la plus connue d’Prompt / injection de prompt Consigne donnée à un modèle / attaque qui détourne ces consignes via du contenu. Voir le glossaire : un texte qui demande au modèle d’oublier ses instructions de départ. Elle ne fonctionne pas toujours, mais elle fonctionne assez souvent pour être prise au sérieux. Le module Sécurité et arnaques en montre d’autres formes.

À retenir

  • Un agent agit dans vos logiciels ; c’est ce qui en fait un gain de temps, et un risque.
  • Ce qu’il lit de l’extérieur (formulaire, email, document) doit être traité comme une donnée, jamais comme une consigne.
  • Plus ses droits sont larges, plus une erreur ou une attaque peut coûter cher.

Sources

Contenu tiré de la base de connaissance du site (§3.2, §8.1), dont chaque affirmation est sourcée et datée. Dernière vérification des sources : 24 septembre 2026.

Fin de l’étape

Faites les activités de la page, puis terminez l’étape.