GUIDE MMK · CRÉER

Créer son premier agent IA

Confier une tâche répétitive à un assistant autonome, sans lui donner les clés de tout.

Intermédiaire9 min de lecture3 h de mise en œuvreMis à jour le 26 juillet 2026
UN AGENT UTILE RESTE SOUS CONTRÔLE
01Déclencheur
02Action
03Contrôle humain
04Résultat

Commencer petit, garder un journal, limiter les autorisations.

LE CADRE DU GUIDE

Savoir où l’on va avant de commencer.

CE QUE VOUS ALLEZ OBTENIRConfier une tâche répétitive à un assistant autonome, sans lui donner les clés de tout.

Un agent devient intéressant lorsqu’il peut poursuivre un objectif, utiliser des outils et réagir à leurs résultats. Il devient aussi plus risqué : commencez par une mission étroite avec des limites explicites.

Pour qui
Professionnel · Créateur d’application · Développeur débutant
Temps de mise en œuvre
3 h de mise en œuvre
Coût
Variable selon le modèle, le volume et les outils connectés.
Prérequis
Une tâche répétitive · Un résultat mesurable · Des données de test

POURQUOI J'AI ÉCRIT CE GUIDE

Mon premier agent devait « gérer ma boîte mail ». Je lui ai donné la lecture et l'envoi.

En trois jours, il a répondu à des publicités, relancé quelqu'un qui avait déjà payé, et adressé une réponse commerciale à un fournisseur.

Il n'était pas mauvais. Je ne lui avais pas donné de mission. Je lui avais donné un souhait.


LE RÉSULTAT

Un agent qui traite une tâche précise, dont vous voyez chaque décision, et que vous pouvez arrêter.

Un agent se distingue d'un assistant par une chose : il agit en boucle. Il poursuit un objectif, utilise des outils, regarde le résultat, recommence. Cette boucle le rend utile. Elle le rend aussi risqué.

Ce que vous repartez avec : la fiche de spécification en dix lignes, la règle des trois permissions, deux prompts.


LE TEST DE DÉPART

  1. La tâche que vous voulez automatiser, la faites-vous vous-même aujourd'hui ?
  2. Pouvez-vous dire à quoi ressemble une bonne sortie ?
  3. Sauriez-vous l'arrêter en cours d'exécution ?
  4. Que se passe-t-il s'il se trompe vingt fois de suite ?

La première est éliminatoire. On n'automatise pas une tâche qu'on ne sait pas faire soi-même : on ne saurait pas juger le résultat.


LE PRINCIPE

Le danger vient de la boucle, pas du modèle. Un assistant classique produit une réponse fausse, vous la voyez, vous la jetez. Un agent enchaîne : une erreur au deuxième tour devient l'entrée du troisième. Vingt tours plus tard, personne ne sait d'où vient le problème.

Trois permissions, jamais confondues. Lire est presque toujours sans danger. Proposer — préparer un brouillon, une liste, une suggestion — couvre l'essentiel des besoins réels. Exécuter — envoyer, publier, payer, supprimer — est le seul niveau qui engage. La grande majorité des agents utiles s'arrêtent à « proposer », et c'est déjà énorme.

Une mission étroite réussit ; une mission large échoue toujours. « Gère ma boîte mail » n'est pas une mission. « Repère les demandes de devis et prépare un brouillon de réponse » en est une : elle a une entrée, une sortie, un critère de réussite.

EN CLAIR — Un agent n'est pas un assistant plus intelligent. C'est un assistant qui recommence tout seul.


LA MÉTHODE — 5 ÉTAPES

Étape 1 — Réduire la mission à une phrase

20 minutes

Format : « À chaque [déclencheur], l'agent [action] et produit [sortie]. »

Si vous avez besoin d'un « et aussi », coupez. Un deuxième agent vaut toujours mieux qu'un agent à deux missions.

On passe à la suite avec une phrase, un déclencheur, une sortie.

Étape 2 — Écrire la fiche de spécification

40 minutes

ChampContenu
MissionUne phrase
DéclencheurQuand il se lance
EntréesCe qu'il a le droit de lire
OutilsCe qu'il a le droit d'utiliser
PermissionsLire / Proposer / Exécuter, par outil
Sortie attendueFormat précis
Validation humaineCe qui passe par vous
Règles d'arrêtQuand il s'arrête et demande
JournalCe qui est enregistré
RéussiteComment vous mesurerez

Étape 3 — Écrire les règles d'arrêt avant les règles d'action

20 minutes

C'est ce qui distingue un agent utilisable d'une expérience amusante. Cinq règles suffisent pour commencer.

  • Trois tentatives sans y arriver
  • Une donnée jamais vue
  • Un seuil dépassé — montant, nombre de destinataires, nombre de fichiers
  • Une action irréversible
  • Un doute. Il doit avoir le droit de le dire

Étape 4 — Tester sur des données fausses, puis sur un échantillon

1 heure

Trois séries : cas normaux, cas limites (donnée vide, format inattendu, doublon), cas absurdes (consigne contradictoire). Puis dix cas réels, en mode « proposer » uniquement.

Comparez à ce que vous auriez fait. Un résultat différent du vôtre n'est pas forcément faux — mais vous devez comprendre pourquoi.

Étape 5 — Mesurer trois choses, pas dix

Sur deux semaines

Le temps réellement gagné, corrections comprises. Le taux de correction : combien de sorties vous retouchez. Les arrêts : c'est le meilleur indicateur de santé, pas un signe d'échec.

Un agent qui ne s'arrête jamais n'est pas performant. Il est aveugle.


L'OBJECTION

« Rester en mode "proposer" pendant des semaines, c'est se priver de l'automatisation qu'on cherchait. » C'est vrai, et beaucoup s'arrêtent là par prudence excessive.

Ma position : relire un brouillon prend dix secondes, et couvre 90 % du gain. Le passage à l'exécution automatique apporte les 10 % restants et concentre 100 % du risque.

Passez à l'exécution quand vous avez les chiffres pour le justifier. Pas avant. Et pas jamais non plus — la prudence indéfinie est une autre façon de ne rien faire.


PROMPTS

De la tâche à la spécification

Transforme cette tâche répétitive en spécification d'agent. Décris :
mission en une phrase, déclencheur, entrées autorisées, outils,
permissions minimales par outil (lire / proposer / exécuter), sortie
attendue, validations humaines, règles d'arrêt, journal, cas limites,
critères de réussite. Signale ce qui, dans ma description, est trop
vague pour être automatisé.

Les règles d'arrêt

Voici la mission d'un agent. Liste dix situations dans lesquelles il
devrait s'arrêter et demander un humain plutôt que continuer. Classe
par gravité. Pour chacune, propose le message exact à afficher.

AVANT / APRÈS

Une artisane reçoit une quinzaine de demandes de devis par semaine, par email. Elle y répond tard le soir, et perd des affaires par lenteur.

AVANT — « un agent qui gère ma boîte mail »

Accès complet à la messagerie, lecture et envoi.

En trois jours : réponses à des publicités, relance d'un client qui avait déjà payé, réponse commerciale envoyée à un fournisseur. Elle coupe tout et conclut que « ça ne marche pas ».

Le problème n'était pas l'agent. C'était l'absence de mission, et le passage direct à « exécuter ».

APRÈS — une mission étroite, en mode proposition

Mission : « À chaque email contenant une demande de devis, l'agent produit une fiche de synthèse et un brouillon de réponse, dans un dossier de brouillons. »

Permissions : lire la messagerie, écrire dans les brouillons. Aucun envoi.

Règles d'arrêt : demande hors zone d'intervention · montant estimé au-dessus de 5 000 € · email contenant une réclamation · doute sur la nature de la demande.

Après deux semaines : 27 demandes traitées, 23 brouillons utilisés après relecture rapide, 4 arrêts dont trois pertinents. Temps de réponse moyen passé de 2 jours à 3 heures.

Ce qui a changé : l'agent fait moins qu'avant. C'est précisément ce qui le rend utilisable au quotidien — elle n'a plus besoin de le surveiller, parce qu'il ne peut rien faire d'irréversible.


CE QUE JE FAIS, MOI

Je n'ai aucun agent en mode exécution. Aucun. Tous s'arrêtent au brouillon, et ça me suffit.

L'indicateur que je regarde en premier n'est pas le temps gagné. C'est le nombre d'arrêts. Un agent qui ne s'arrête jamais ne me rassure pas, il m'inquiète.

Je découpe systématiquement une mission en deux agents plutôt qu'un. C'est moins élégant. C'est beaucoup plus stable.


ERREURS FRÉQUENTES

ErreurCe qu'elle produitLa correction
Donner « exécuter » dès le départDes actions irréversibles non vouluesRester en proposition plusieurs semaines
Automatiser une tâche mal définieUn agent qui invente sa missionUne phrase, un déclencheur, une sortie
Pas de règles d'arrêtUne boucle qui s'entêteCinq règles minimum
Mesurer seulement la vitesseOn ne voit pas le coût des correctionsTemps net, corrections, arrêts
Tester sur les vraies donnéesDes erreurs de mise au point bien réellesDonnées de test, puis échantillon

POINTS DE CONTRÔLE

  • La mission tient en une phrase, avec un déclencheur
  • Les permissions sont séparées en lire / proposer / exécuter
  • Aucune action irréversible sans validation
  • Cinq règles d'arrêt au minimum
  • Chaque exécution laisse un journal
  • Je sais l'arrêter en cours de route

Un bon agent fait moins que ce que vous espériez. C'est exactement pour ça qu'il tourne encore dans six mois.

ACTUALITÉS ASSOCIÉES

Ce qui peut faire évoluer ce guide.