GUIDE MMK · CRÉER
Créer son premier agent IA
Confier une tâche répétitive à un assistant autonome, sans lui donner les clés de tout.
Commencer petit, garder un journal, limiter les autorisations.
LE CADRE DU GUIDE
Savoir où l’on va avant de commencer.
Un agent devient intéressant lorsqu’il peut poursuivre un objectif, utiliser des outils et réagir à leurs résultats. Il devient aussi plus risqué : commencez par une mission étroite avec des limites explicites.
- Pour qui
- Professionnel · Créateur d’application · Développeur débutant
- Temps de mise en œuvre
- 3 h de mise en œuvre
- Coût
- Variable selon le modèle, le volume et les outils connectés.
- Prérequis
- Une tâche répétitive · Un résultat mesurable · Des données de test
POURQUOI J'AI ÉCRIT CE GUIDE
Mon premier agent devait « gérer ma boîte mail ». Je lui ai donné la lecture et l'envoi.
En trois jours, il a répondu à des publicités, relancé quelqu'un qui avait déjà payé, et adressé une réponse commerciale à un fournisseur.
Il n'était pas mauvais. Je ne lui avais pas donné de mission. Je lui avais donné un souhait.
LE RÉSULTAT
Un agent qui traite une tâche précise, dont vous voyez chaque décision, et que vous pouvez arrêter.
Un agent se distingue d'un assistant par une chose : il agit en boucle. Il poursuit un objectif, utilise des outils, regarde le résultat, recommence. Cette boucle le rend utile. Elle le rend aussi risqué.
Ce que vous repartez avec : la fiche de spécification en dix lignes, la règle des trois permissions, deux prompts.
LE TEST DE DÉPART
- La tâche que vous voulez automatiser, la faites-vous vous-même aujourd'hui ?
- Pouvez-vous dire à quoi ressemble une bonne sortie ?
- Sauriez-vous l'arrêter en cours d'exécution ?
- Que se passe-t-il s'il se trompe vingt fois de suite ?
La première est éliminatoire. On n'automatise pas une tâche qu'on ne sait pas faire soi-même : on ne saurait pas juger le résultat.
LE PRINCIPE
Le danger vient de la boucle, pas du modèle. Un assistant classique produit une réponse fausse, vous la voyez, vous la jetez. Un agent enchaîne : une erreur au deuxième tour devient l'entrée du troisième. Vingt tours plus tard, personne ne sait d'où vient le problème.
Trois permissions, jamais confondues. Lire est presque toujours sans danger. Proposer — préparer un brouillon, une liste, une suggestion — couvre l'essentiel des besoins réels. Exécuter — envoyer, publier, payer, supprimer — est le seul niveau qui engage. La grande majorité des agents utiles s'arrêtent à « proposer », et c'est déjà énorme.
Une mission étroite réussit ; une mission large échoue toujours. « Gère ma boîte mail » n'est pas une mission. « Repère les demandes de devis et prépare un brouillon de réponse » en est une : elle a une entrée, une sortie, un critère de réussite.
EN CLAIR — Un agent n'est pas un assistant plus intelligent. C'est un assistant qui recommence tout seul.
LA MÉTHODE — 5 ÉTAPES
Étape 1 — Réduire la mission à une phrase
20 minutes
Format : « À chaque [déclencheur], l'agent [action] et produit [sortie]. »
Si vous avez besoin d'un « et aussi », coupez. Un deuxième agent vaut toujours mieux qu'un agent à deux missions.
On passe à la suite avec une phrase, un déclencheur, une sortie.
Étape 2 — Écrire la fiche de spécification
40 minutes
| Champ | Contenu |
|---|---|
| Mission | Une phrase |
| Déclencheur | Quand il se lance |
| Entrées | Ce qu'il a le droit de lire |
| Outils | Ce qu'il a le droit d'utiliser |
| Permissions | Lire / Proposer / Exécuter, par outil |
| Sortie attendue | Format précis |
| Validation humaine | Ce qui passe par vous |
| Règles d'arrêt | Quand il s'arrête et demande |
| Journal | Ce qui est enregistré |
| Réussite | Comment vous mesurerez |
Étape 3 — Écrire les règles d'arrêt avant les règles d'action
20 minutes
C'est ce qui distingue un agent utilisable d'une expérience amusante. Cinq règles suffisent pour commencer.
- Trois tentatives sans y arriver
- Une donnée jamais vue
- Un seuil dépassé — montant, nombre de destinataires, nombre de fichiers
- Une action irréversible
- Un doute. Il doit avoir le droit de le dire
Étape 4 — Tester sur des données fausses, puis sur un échantillon
1 heure
Trois séries : cas normaux, cas limites (donnée vide, format inattendu, doublon), cas absurdes (consigne contradictoire). Puis dix cas réels, en mode « proposer » uniquement.
Comparez à ce que vous auriez fait. Un résultat différent du vôtre n'est pas forcément faux — mais vous devez comprendre pourquoi.
Étape 5 — Mesurer trois choses, pas dix
Sur deux semaines
Le temps réellement gagné, corrections comprises. Le taux de correction : combien de sorties vous retouchez. Les arrêts : c'est le meilleur indicateur de santé, pas un signe d'échec.
Un agent qui ne s'arrête jamais n'est pas performant. Il est aveugle.
L'OBJECTION
« Rester en mode "proposer" pendant des semaines, c'est se priver de l'automatisation qu'on cherchait. » C'est vrai, et beaucoup s'arrêtent là par prudence excessive.
Ma position : relire un brouillon prend dix secondes, et couvre 90 % du gain. Le passage à l'exécution automatique apporte les 10 % restants et concentre 100 % du risque.
Passez à l'exécution quand vous avez les chiffres pour le justifier. Pas avant. Et pas jamais non plus — la prudence indéfinie est une autre façon de ne rien faire.
PROMPTS
De la tâche à la spécification
Transforme cette tâche répétitive en spécification d'agent. Décris :
mission en une phrase, déclencheur, entrées autorisées, outils,
permissions minimales par outil (lire / proposer / exécuter), sortie
attendue, validations humaines, règles d'arrêt, journal, cas limites,
critères de réussite. Signale ce qui, dans ma description, est trop
vague pour être automatisé.
Les règles d'arrêt
Voici la mission d'un agent. Liste dix situations dans lesquelles il
devrait s'arrêter et demander un humain plutôt que continuer. Classe
par gravité. Pour chacune, propose le message exact à afficher.
AVANT / APRÈS
Une artisane reçoit une quinzaine de demandes de devis par semaine, par email. Elle y répond tard le soir, et perd des affaires par lenteur.
AVANT — « un agent qui gère ma boîte mail »
Accès complet à la messagerie, lecture et envoi.
En trois jours : réponses à des publicités, relance d'un client qui avait déjà payé, réponse commerciale envoyée à un fournisseur. Elle coupe tout et conclut que « ça ne marche pas ».
Le problème n'était pas l'agent. C'était l'absence de mission, et le passage direct à « exécuter ».
APRÈS — une mission étroite, en mode proposition
Mission : « À chaque email contenant une demande de devis, l'agent produit une fiche de synthèse et un brouillon de réponse, dans un dossier de brouillons. »
Permissions : lire la messagerie, écrire dans les brouillons. Aucun envoi.
Règles d'arrêt : demande hors zone d'intervention · montant estimé au-dessus de 5 000 € · email contenant une réclamation · doute sur la nature de la demande.
Après deux semaines : 27 demandes traitées, 23 brouillons utilisés après relecture rapide, 4 arrêts dont trois pertinents. Temps de réponse moyen passé de 2 jours à 3 heures.
Ce qui a changé : l'agent fait moins qu'avant. C'est précisément ce qui le rend utilisable au quotidien — elle n'a plus besoin de le surveiller, parce qu'il ne peut rien faire d'irréversible.
CE QUE JE FAIS, MOI
Je n'ai aucun agent en mode exécution. Aucun. Tous s'arrêtent au brouillon, et ça me suffit.
L'indicateur que je regarde en premier n'est pas le temps gagné. C'est le nombre d'arrêts. Un agent qui ne s'arrête jamais ne me rassure pas, il m'inquiète.
Je découpe systématiquement une mission en deux agents plutôt qu'un. C'est moins élégant. C'est beaucoup plus stable.
ERREURS FRÉQUENTES
| Erreur | Ce qu'elle produit | La correction |
|---|---|---|
| Donner « exécuter » dès le départ | Des actions irréversibles non voulues | Rester en proposition plusieurs semaines |
| Automatiser une tâche mal définie | Un agent qui invente sa mission | Une phrase, un déclencheur, une sortie |
| Pas de règles d'arrêt | Une boucle qui s'entête | Cinq règles minimum |
| Mesurer seulement la vitesse | On ne voit pas le coût des corrections | Temps net, corrections, arrêts |
| Tester sur les vraies données | Des erreurs de mise au point bien réelles | Données de test, puis échantillon |
POINTS DE CONTRÔLE
- La mission tient en une phrase, avec un déclencheur
- Les permissions sont séparées en lire / proposer / exécuter
- Aucune action irréversible sans validation
- Cinq règles d'arrêt au minimum
- Chaque exécution laisse un journal
- Je sais l'arrêter en cours de route
Un bon agent fait moins que ce que vous espériez. C'est exactement pour ça qu'il tourne encore dans six mois.
ACTUALITÉS ASSOCIÉES

