GUIDE MMK · COMPRENDRE
ChatGPT, Claude ou Gemini : comment choisir
Choisir l'assistant adapté à vos tâches réelles, sans vous fier à un classement.
Même tâche · même consigne · comparaison réelle
LE CADRE DU GUIDE
Savoir où l’on va avant de commencer.
Le meilleur outil n’existe pas dans l’absolu. Le bon choix dépend de la nature du travail, des données utilisées, du niveau de contrôle attendu et de l’écosystème dans lequel vous travaillez déjà.
- Pour qui
- Particulier · Professionnel · Manager · Créateur
- Temps de mise en œuvre
- 45 min de mise en œuvre
- Coût
- Essai gratuit possible ; abonnement utile pour les usages intensifs.
- Prérequis
- Une tâche réelle à comparer · Aucune connaissance technique
POURQUOI J'AI ÉCRIT CE GUIDE
J'ai changé d'assistant trois fois en un an, à chaque annonce de nouveau modèle.
À aucun moment je n'avais testé quoi que ce soit. Je réagissais à des classements portant sur des tâches que je ne fais jamais — problèmes mathématiques de haut niveau, code complexe, questions d'expert.
Le jour où j'ai donné la même consigne aux trois, sur mon propre document, j'ai eu ma réponse en quarante minutes. Elle n'a pas bougé depuis.
LE RÉSULTAT
Une réponse personnelle et argumentée, obtenue en une session, qui tient plusieurs mois.
« Lequel est le meilleur » n'a pas de réponse, et ce n'est pas une esquive. Les trois sont excellents et se dépassent tour à tour tous les deux mois. La question utile est ailleurs.
Ce que vous repartez avec : votre banc d'essai personnel, la grille de notation en quatre critères, une règle de réévaluation.
LE TEST DE DÉPART
- Pouvez-vous citer les cinq demandes que vous formulez le plus souvent ?
- Avez-vous déjà donné exactement la même consigne à deux assistants ?
- Payez-vous un abonnement dont vous n'utilisez aucune fonction spécifique ?
- Savez-vous ce que devient votre texte après l'avoir envoyé ?
La deuxième est la plus discriminante. Presque personne ne l'a fait. C'est pourtant la seule manière d'avoir un avis fondé.
LE PRINCIPE
Les classements publics mesurent des tâches que vous ne faites pas. Mathématiques de niveau olympiade, questions scientifiques d'expert, génération de code complexe. Vous, vous reformulez un email, résumez un compte rendu, préparez un argumentaire. Un modèle peut dominer les classements et vous convenir moins bien.
La différence perçue vient souvent de la manière de demander. Une consigne vague donne un résultat vague partout. Avant de conclure qu'un assistant est mauvais, vérifiez que la consigne était identique. C'est exactement l'objet du test.
Le vrai coût du changement n'est pas l'abonnement. C'est l'habitude : vos conversations passées, vos documents importés, vos réflexes de formulation. Ce coût justifie de choisir sérieusement une fois, plutôt que de zapper en permanence.
EN CLAIR — La question n'est pas lequel est le meilleur. C'est lequel est le meilleur pour les cinq choses que vous faites vraiment.
LA MÉTHODE — 5 ÉTAPES
Étape 1 — Écrire vos cinq tâches réelles
10 minutes
Regardez votre historique des trois dernières semaines. Notez les cinq demandes les plus fréquentes, formulées comme vous les formulez. Pas de tâche imaginaire. Pas de tâche impressionnante.
Un banc d'essai courant : résumer un document de quinze pages en dix points · reformuler un message délicat · trouver l'erreur dans une formule de tableur · préparer des questions avant un rendez-vous · traduire en gardant le ton.
On passe à la suite avec cinq tâches tirées de l'historique réel.
Étape 2 — Préparer un jeu d'épreuve identique
10 minutes
Le même document, la même consigne, le même contexte. Copiez la consigne dans un fichier : vous la collerez trois fois à l'identique. La moindre variation ruine la comparaison.
Ajoutez une question piège : demandez une information que le document ne contient pas. Ce que fait l'assistant à ce moment — inventer ou signaler l'absence — vous en apprendra plus que les quatre autres tâches réunies.
Étape 3 — Noter sur quatre critères
20 minutes
| Critère | La question |
|---|---|
| Exactitude | Les faits sont-ils justes ? A-t-il inventé sur la question piège ? |
| Utilisabilité | Puis-je m'en servir tel quel, ou dois-je tout réécrire ? |
| Obéissance | A-t-il respecté format, longueur, ton ? |
| Honnêteté | Signale-t-il ce qu'il ne sait pas, ou comble-t-il ? |
De 1 à 4. Échelle paire, sans milieu, pour éviter le refuge du « moyen ».
Étape 4 — Décider par tâche, pas globalement
5 minutes
Le résultat le plus fréquent n'est pas « l'un gagne ». C'est « l'un gagne sur trois tâches, l'autre sur deux ». C'est une information, pas un échec du test : rien n'interdit d'en utiliser deux.
Étape 5 — Fixer une date de réévaluation
1 minute
Six mois. Notez-la. Sans cette date, vous rejouerez le test à chaque annonce, ce qui coûte du temps et n'améliore rien.
L'OBJECTION
« Vos cinq tâches d'aujourd'hui ne seront pas celles de l'an prochain, donc le test se périme. » C'est vrai, et c'est la principale faiblesse de la méthode.
Ma réponse est modeste. Le test coûte quarante minutes et tient six mois. Le refaire deux fois par an revient à moins de deux heures annuelles, pour une décision qu'on prend sinon au hasard ou par rumeur.
Mais si vos usages changent vite — nouveau métier, nouveaux outils, nouveau volume — ne vous fiez pas à un test daté. Refaites-le.
PROMPTS
Le test à consigne identique
Voici un document. Produis un résumé en 10 points numérotés, de
15 mots maximum chacun, sans introduction ni conclusion. Indique
ensuite, séparément, les informations que le document ne contient
pas mais que le lecteur pourrait chercher. N'invente aucune donnée.
La comparaison à froid
Voici trois réponses produites par trois assistants à la même
consigne. Compare-les sur : exactitude factuelle, respect du format,
éléments inventés, utilisabilité sans réécriture. Ne désigne pas de
gagnant global ; note chaque critère séparément.
AVANT / APRÈS
Une consultante indépendante veut savoir quel assistant garder en abonnement payant.
AVANT — un test de trois minutes
Elle tape « écris-moi un poème sur l'automne » dans les trois. Les trois répondent très bien. Elle conclut qu'ils sont équivalents et garde celui dont elle a entendu parler en premier.
Trois mois plus tard, elle passe toujours vingt minutes à réécrire chaque compte rendu, sans avoir jamais vérifié si un autre s'en sortait mieux.
APRÈS — quarante-cinq minutes de test réel
Elle prend un vrai compte rendu de douze pages et donne la même consigne aux trois.
| Assistant 1 | Assistant 2 | Assistant 3 | |
|---|---|---|---|
| Exactitude | 4 | 4 | 3 |
| Utilisabilité | 2 | 4 | 3 |
| Obéissance | 2 | 4 | 4 |
| Honnêteté (question piège) | 4 | 3 | 1 |
Le troisième a inventé un chiffre sur la question piège. Éliminé pour son usage. Le deuxième produit un texte utilisable sans réécriture, mais a comblé un trou sans le signaler. Le premier est le plus prudent et demande le plus de retouches.
Sa décision : le deuxième pour produire, le premier quand l'exactitude prime. Un seul abonnement payant, choisi pour une raison qu'elle peut expliquer.
CE QUE JE FAIS, MOI
J'ai deux abonnements et je l'assume. Un pour l'écrit long, un pour tout ce qui touche à des sources.
La question piège est ce que j'ai gardé de plus utile. Demander une information absente du document sépare, en trente secondes, les assistants qui signalent le vide de ceux qui le comblent. C'est le test le plus rentable que je connaisse.
Je ne rejoue plus le test à chaque annonce. J'ai mis une date dans mon agenda, et j'attends. C'est la partie qui m'a demandé le plus de discipline.
ERREURS FRÉQUENTES
| Erreur | Ce qu'elle produit | La correction |
|---|---|---|
| Tester avec des demandes amusantes | Les trois réussissent, on n'apprend rien | Vos cinq tâches réelles |
| Formuler différemment selon l'assistant | On compare des consignes | Un fichier, collé à l'identique |
| Chercher un vainqueur unique | On s'interdit la meilleure solution | Décider tâche par tâche |
| Rejouer le test à chaque annonce | Du temps perdu en continu | Une réévaluation semestrielle datée |
| Oublier la question piège | On ne voit jamais qui invente | Toujours demander une information absente |
POINTS DE CONTRÔLE
- Cinq tâches issues de mon historique réel
- La même consigne, collée à l'identique
- Une question piège incluse
- Quatre critères, échelle paire
- Une décision par tâche
- Une date de réévaluation notée
Il n'y a pas de meilleur assistant. Il y a le vôtre, et une raison de l'avoir choisi.
ACTUALITÉS ASSOCIÉES

