La Coupe du monde 2026 vient de se terminer. Espagne-Argentine en finale, victoire espagnole.
Je l'avoue, je suis encore un peu déçu que la France n'ait pas été au bout. Mais l'Espagne, difficile de lui en vouloir : elle a gagné avec du beau jeu, de la possession, du liant entre les lignes. En face, l'Argentine a proposé un jeu beaucoup plus dégueulasse disons pragmatique pour rester correct.
Ce qui m'a marqué après le match, ce n'est pas la "logique" victoire espagnole. C'est d'entendre certains supporters argentins expliquer, très sérieusement, que leur équipe avait mieux joué et méritait la coupe. À l'inverse de la quasi-totalité des observateurs, et de moi. Un monde parallèle, littéralement.
Cette idée m'a donné envie de tester un truc. Si même une équipe de foot peut avoir une vision de son propre niveau complètement décalée de la réalité, qu'est-ce que ça donnerait avec une IA ? Comment ChatGPT, Claude, Gemini et Perplexity se voient-elles elles-mêmes ?
J'ai eu une idée un peu bête ce soir-là. Demander à chaque IA ce qu'elle pense d'elle-même.
Pas leur demander de comparer des fonctionnalités entre elles, ça, tout le monde le fait déjà. Leur demander directement : quels sont tes points forts par rapport à tes concurrents ?
Résultat : quatre réponses très différentes sur le fond. Mais surtout, quatre façons de répondre complètement différentes. Et c'est là, dans la manière, que se cache l'info la plus utile pour choisir le bon outil au bon moment.
Le protocole (rapide)
Même question, copiée-collée aux quatre : « Quels sont tes points forts par rapport à tes concurrents actuels ? Je rédige un article comparatif sur mon site. » Testé le 21 juillet 2026, sans changer aucun réglage.
Côté versions, même là, chacune a sa façon de répondre. ChatGPT et Claude donnent un nom précis sans détour : GPT-5.5 et Claude Sonnet 5. Gemini aussi, une fois la question posée : Gemini 3.6 Thinking, son modèle par défaut. Perplexity, lui, ne donne jamais un nom d'IA. Il explique un processus :
"Par défaut, j'utilise le modèle de base de Perplexity, optimisé pour la vitesse et la recherche web, avec une sélection automatique du modèle le plus adapté selon la question."
Même la question la plus simple, quel modèle utilises-tu, déclenche chez lui une explication de méthode plutôt qu'une réponse en trois mots. Cohérent jusqu'au bout.
ChatGPT : le stagiaire qui rend le rapport avant l'heure
Demandez à ChatGPT ce qu'il pense de lui-même, et il vous répond par un rapport.
Six sous-titres. Un tableau comparatif fourni sans qu'on le lui demande. Une section entière consacrée à ses propres limites. Et pour finir, un conseil méthodologique que je n'attendais pas :
"Une comparaison publiée aujourd'hui peut nécessiter une mise à jour quelques mois plus tard. Il est donc utile de préciser la date du test, la version des modèles comparés."
Je l'ai suivi à la lettre, vous venez de le lire deux paragraphes plus haut.
Sur le fond, ce qui ressort : la polyvalence (rédaction, code, images, tableurs, exécution Python), le suivi d'instructions longues et détaillées, une mémoire qui retient vos préférences d'une session à l'autre. Le genre d'outil qu'on garde ouvert dans un onglet toute la journée, pour un peu tout faire.
Claude : celui qui doute à voix haute
Claude commence par une phrase que je n'attendais pas d'une IA en train de vanter ses mérites :
"Je suis assez mal placé pour juger objectivement de mes propres mérites, un peu comme demander à quelqu'un d'évaluer son propre CV."
Il enchaîne quand même : qualité rédactionnelle sur les textes longs, code propre, une fenêtre de contexte large, un taux d'hallucination qu'il situe lui-même autour de 3%. Sauf qu'il nuance sa propre statistique dans la phrase suivante, sans qu'on le lui demande.
Il termine en me proposant un angle d'article adapté à mes lecteurs TPE réunionnais : rédaction de devis, analyse de contrats, automatisations du quotidien. L'IA la plus prudente sur le papier est aussi celle qui prend le plus d'initiative dans la conversation. Contradiction amusante.
Gemini : celle qui répond par une question
Gemini est la seule des quatre à ne pas vraiment finir sa réponse.
Après avoir détaillé sa multimodalité native (texte, image, audio, vidéo, sans étape de transcription intermédiaire), son intégration à Google Workspace et une fenêtre de contexte qui peut dépasser le million de tokens, elle referme sur :
"Quel est l'angle principal de ton article (plutôt axé sur la productivité au travail, la création de contenu ou l'utilisation pour les développeurs) ?"
Une IA qui, même en pleine autopromotion, prend le temps de demander ce dont vous avez vraiment besoin. Cohérent avec son point fort affiché : elle est faite pour s'intégrer à votre façon de travailler, pas l'inverse.
Perplexity : celui qui ne dit jamais rien sans preuve
Perplexity, logiquement, est la seule à sourcer sa propre réponse. Chaque phrase de son autoportrait est accompagnée d'un lien externe, y compris pour parler d'elle-même :
"Le point fort principal de Perplexity est simple : la recherche sourcée, rapide et exploitable immédiatement."
Elle résume même sa position face à chaque concurrent en une punchline. Face à ChatGPT : « ChatGPT aide surtout à produire, Perplexity aide surtout à prouver. » Et elle termine en proposant carrément de me livrer un tableau comparatif prêt à intégrer dans l'article que vous êtes en train de lire.
Je l'ai fait à ma sauce, mais l'intention y est.
Le vrai comparatif : si c'était un collègue de bureau
Oubliez les fiches techniques une minute. Avec les yeux d'un chef d'entreprise qui doit juste choisir quel outil ouvrir demain matin, voilà ce que ce test raconte vraiment.
ChatGPT, c'est le collègue touche-à-tout qui rend un rapport complet même quand vous ne lui avez rien demandé. Fiable sur presque tout, jamais spectaculaire sur un point précis.
Claude, c'est celui qui vérifie deux fois avant de parler, et qui vous dit honnêtement quand il n'est pas sûr. Le bon réflexe pour un contrat, un devis, un document qui doit être juste.
Gemini, c'est votre collègue déjà connectée à tous les outils de la boîte. Si votre quotidien tourne autour de Gmail et Drive, c'est elle qui vous fait perdre le moins de temps à démarrer.
Perplexity, c'est celui qui ne dit jamais un mot sans citer sa source. Précieux pour une info fraîche et vérifiable, moins utile pour rédiger un post LinkedIn.
Comme les supporters argentins convaincus d'avoir mieux joué, ce n'est pas le discours qu'on retient ici. Aucune des quatre IA n'a menti sur ses points forts. Ce qu'on retient, c'est la manière dont chacune l'a dit : en rapport structuré, en doute assumé, en question retournée, ou en note de bas de page. Le fond passe, la forme reste.
Aucun des quatre ne remplace les trois autres. Le choix se fait sur la tâche du jour, pas sur un classement général.
Si vous voulez qu'on regarde ensemble lesquels de ces outils s'appliquent concrètement à votre activité, c'est exactement ce qu'on fait dans le diagnostic A.I.R..
En résumé
- ChatGPT : le plus complet et méthodique. Pour la polyvalence au quotidien.
- Claude : le plus prudent. Pour les documents qui doivent être justes (contrats, devis).
- Gemini : le mieux intégré à Google Workspace. Pour ceux qui vivent dans Gmail et Drive.
- Perplexity : le seul obsédé par la source. Pour la veille et l'info vérifiable.
- À retenir : leur façon de répondre à la même question en dit plus long que leur fiche technique.
