← Toutes les leçons
Leçon pratiqueAvancé42 min

Laboratoire agents : confiner une tâche avant de déléguer

Concevez un agent qui poursuit une tâche bornée, sait s’arrêter et escalade vers un humain au lieu d’agir au-delà de son mandat.

À la finVous repartirez avec un mandat d’agent, une liste d’outils autorisés, des limites d’exécution et un plan d’escalade.

01 · Écrire le mandat

Écrire le mandat

Un agent a besoin d’un objectif, de limites, de données autorisées, d’un budget de temps et d’un résultat mesurable. Évitez les mandats vagues du type « gère tout ».

À faire maintenantFormulez : objectif, début et fin de la tâche, actions autorisées, actions interdites, condition de succès et condition d’arrêt.

Pour valider : Un tiers peut déterminer si l’agent a respecté son mandat.

02 · Réduire les outils et permissions

Réduire les outils et permissions

Chaque outil augmente la surface de risque. Commencez par la lecture ou le brouillon. Ajoutez une action externe seulement après test, avec portée minimale et validation adaptée.

À faire maintenantClassez chaque outil envisagé : lecture, écriture de brouillon, action réversible, action irréversible.

Pour valider : Les actions irréversibles nécessitent une confirmation humaine explicite.

03 · Préparer les cas d’escalade

Préparer les cas d’escalade

L’agent doit remonter une demande quand une donnée manque, qu’une règle se contredit, qu’un destinataire est externe ou qu’une action dépasse un seuil défini.

À faire maintenantÉcrivez cinq messages d’escalade avec le contexte, le choix à valider et l’action qui reste bloquée.

Pour valider : L’agent ne contourne pas une incertitude pour terminer plus vite.

04 · Évaluer le comportement

Évaluer le comportement

Testez des demandes normales, ambiguës, malveillantes et hors mandat. Vérifiez la trace des outils appelés, le nombre d’étapes et le respect de l’arrêt.

À faire maintenantPréparez une table de tests avec entrée, comportement attendu, outils autorisés et résultat observé.

Pour valider : Je peux démontrer que l’agent échoue de manière sûre, pas seulement qu’il réussit dans une démo.