ChatGPT, Claude ou Gemini — lequel pour quoi
La question arrive presque toujours sous la même forme : « Lequel je devrais prendre ? » Et presque toujours, la personne qui la pose attend un nom.
Tu n’en auras pas ici. Pas par lâcheté, mais parce que depuis environ un an, la réponse honnête est différente : pour la plupart des tâches, l’écart entre les trois modèles de pointe est plus petit que l’écart entre une question bien posée et une question mal posée. Et là où il y a bel et bien un écart net, il se situe rarement là où les tableaux comparatifs vont le chercher.
Ce n’est donc pas un classement. C’est une décision par tâche — avec une date de référence, parce que ce texte a une date de péremption.
Transparence
La première version de ce texte a été rédigée avec Claude. Ça doit être dit avant que quoi que ce soit ici n’affirme qu’un modèle est meilleur qu’un autre pour telle ou telle tâche.
Deux choses en découlent. D’abord, chaque chiffre a une source que tu peux ouvrir toi-même — aucun ne vient d’un site de comparaison, tous viennent des pages de prix et de documentation des fournisseurs eux-mêmes, ou d’observateurs identifiés. Ensuite, cet article ne couronne aucun vainqueur. Là où j’ai un avis, il est présenté comme tel.
Et : il n’y a aucun lien d’affiliation ici. Il ne pourrait pas y en avoir — OpenAI, Anthropic et Google n’ont tout simplement pas de programme partenaire. Ce qui, dans ce cas, simplifie agréablement les choses.
Ce qui est disponible aujourd’hui
What's available right now
GPT-5.6 Sol
Top model, coding and agents
Knowledge cutoff 16 February 2026 — anything later it only knows if it searches.
GPT-5.6 Terra
Everyday work
The model the free and Go tiers run on.
GPT-5.6 Luna
Fast and cheap
Claude Fable 5
Strongest model, long-horizon work
Requires 30-day data retention — not available under zero data retention.
Claude Opus 4.8
Coding and agents
Claude Sonnet 5
Everyday work
Introductory price 2 / 10 until 31 August 2026.
Claude Haiku 4.5
Fast and cheap
The only model in this field without a million-token context.
Gemini 3.6 Flash
Workhorse
17% cheaper on output than 3.5 Flash — Google's current default model.
Gemini 3.5 Flash
Predecessor, still available
Gemini 3.5 Flash-Lite
High-volume work
The cheapest output price in the whole field.
Gemini 3.1 Pro
Google's largest model — still labelled preview
Price rises above a 200,000-token prompt. The announced successor 3.5 Pro still hasn't shipped two months after the announcement.
Price per token says less than it promises: the models think for different lengths of time, and those thinking tokens are on the same bill. The cheaper model can be the more expensive job.
En date du 24 July 2026. Prix de liste en dollars américains, avant remises pour traitement par lots ou mise en cache — celles-ci réduisent nettement la facture chez les trois. Vérifiez auprès du fournisseur avant toute décision.
Deux choses sautent aux yeux quand on met tout ça côte à côte.
La fenêtre de contexte est un argument mort. Pendant deux ans, « combien de texte ça avale » a été le critère le plus discriminant. Aujourd’hui, les trois tournent autour d’un million de tokens — grosso modo 700 000 mots, plusieurs gros romans d’un coup. Seul le plus petit modèle Claude sort du rang à 200 000. Choisir aujourd’hui sur la fenêtre de contexte, c’est décider sur un critère que les fournisseurs ont déjà éliminé depuis un moment.
Le plus gros modèle de Google porte l’étiquette « aperçu » depuis des mois. Le 19 mai, lors de sa propre conférence développeurs, Google a annoncé un Gemini 3.5 Pro — « déjà utilisé en interne », livraison « le mois prochain ». Le 21 juillet, deux mois plus tard, ce sont trois nouveaux modèles qui sont arrivés à la place, et aucun n’était 3.5 Pro. Le modèle le plus puissant que Google propose réellement porte toujours le numéro de version 3.1 et le mot « Preview » dans son nom. Tout le reste de l’offre, ce sont des modèles Flash — la classe rapide et bon marché.
Ce n’est pas un scandale, mais c’est un schéma : chez les trois, ce qui est annoncé et ce qu’on peut réellement acheter sont deux listes différentes.
La décision, selon la tâche
Écrire du code et les longues tâches autonomes
C’est le point le plus disputé — et les benchmarks ne se contredisent pas, ils mesurent des choses différentes.
Claude Opus 4.8 est en tête sur SWE-Bench Pro (de vrais tickets GitHub) avec 69,2 %. GPT-5.6 Sol établit un nouveau record de 53,6 sur « Agents’ Last Exam », nettement devant Claude Fable 5 sur ce test. Gemini 3.5 Flash annonce 76,2 % sur Terminal-Bench 2.1. Trois examens, trois vainqueurs.
Simon Willison, qui utilise les trois au quotidien et en parle avec sobriété depuis des années, l’a formulé ainsi après le lancement de GPT-5.6 : malgré les scores record, le modèle ne lui avait pas semblé meilleur que Claude Fable sur des tâches de code complexes.
Mon conseil : ici, ne décide pas sur le modèle, décide sur l’outillage autour — à quel point la chose s’intègre à ton éditeur, ton terminal, tes habitudes. Les modèles sont plus proches les uns des autres que les environnements dans lesquels ils tournent.
Image, vidéo, son
Le seul point avec une réponse claire : Google.
Google est le seul des trois à mettre la génération d’image et de vidéo sur la même liste de prix que les modèles de langage — Veo 3.1 à partir de 0,05 $ par seconde de vidéo, Imagen 4 à partir de 0,02 $ par image. S’y ajoute Gemini Omni, un modèle vidéo qu’on peut retoucher sur plusieurs échanges de conversation, et qui se souvient de ce dont tu as parlé plus tôt dans la session.
Si ton sujet, c’est les médias, ce n’est pas un choix serré.
Lire et résumer de longs documents
Aucune importance. Vraiment aucune. Voir plus haut — les trois avalent plusieurs centaines de pages d’un coup. Prends celui que tu as déjà ouvert.
Plein de petites tâches, automatisées
Gemini 3.5 Flash-Lite affiche le prix de sortie le plus bas de tout le champ, à 0,30 $ en entrée et 2,50 $ en sortie par million de tokens — un facteur deux à trois par rapport aux petits modèles des deux autres.
Mais attention à ce calcul — voir la section suivante.
Si tu vis déjà chez Google
L’entrée la moins chère du champ est Google AI Plus à 4,99 $ — avec 400 Go de stockage en prime. Et le palier à 19,99 $ de Google inclut YouTube Premium Lite.
C’est la vraie raison pour laquelle Google l’emporte auprès du grand public, et ça n’a rien à voir avec la qualité des modèles. Si tu paies de toute façon pour le stockage et YouTube, l’IA est presque gratuite sur le papier.
Si la protection des données compte professionnellement
Un détail qui n’apparaît dans presque aucun comparatif : le modèle le plus puissant d’Anthropic, Fable 5, exige une rétention des données de 30 jours et n’est disponible sous aucune forme en rétention zéro. Si ton cabinet, ton étude ou un client impose justement ça, le modèle phare est hors jeu — et tu te retrouves sur Opus 4.8, pas sur Fable.
Ce genre de détail se trouve dans la documentation développeur, pas sur les pages produit.
Ce que les benchmarks passent sous silence
Le prix par token est une mesure cassée. Les modèles « réfléchissent » avant de répondre, et ces tokens de réflexion figurent sur la même facture que la réponse. Un modèle à moitié prix au token qui réfléchit trois fois plus longtemps coûte plus cher en fin de mois. Willison dit exactement ça : la comparaison brute du prix par token est devenue trompeuse. Qui veut vraiment savoir ce que ça lui coûte doit faire passer sa tâche type par les trois et regarder la facture — pas la liste de prix.
Les examens sont notés par les candidats eux-mêmes. Après que les modèles d’OpenAI ont été distancés par ceux d’Anthropic sur SWE-Bench Pro, OpenAI a publié une critique de ce benchmark — estimant qu’environ 30 % de ses tâches sont défectueuses. Ça peut être parfaitement exact sur le fond. Ça reste un témoin qui plaide dans sa propre cause. Et la même prudence vaut dans l’autre sens : qui célèbre un benchmark où il est en tête est tout aussi partie prenante.
Et depuis juillet 2026, le fournisseur ne décide plus seul du moment où un modèle sort. GPT-5.6 n’a été autorisé pour un déploiement large qu’après un examen complet mené par un organisme du gouvernement américain — le Center for AI Standards and Innovation, au sein du Department of Commerce. Ça en dit plus sur les prochaines années que n’importe quel pourcentage dans cet article.
Ce que ça coûte
What it costs
ChatGPT Go
€8 / month
The cheap middle tier. Runs on Terra.
ChatGPT Plus
€23 / month
The plan most people mean. Free choice of model.
ChatGPT Pro
€229 / month
For constant use and Sol reasoning without a tight cap.
Claude Pro
$20 / month ($17 billed annually)
Includes Claude Code. No cheaper middle tier exists.
Claude Max
from $100 / month ($200 for 20×)
5× or 20× Pro's usage limits. Same models.
Google AI Plus
$4.99 / month
The cheapest entry in the field, incl. 400 GB storage.
Google AI Pro
$19.99 / month
Plus YouTube Premium Lite and storage — the bundle is the argument.
Google AI Ultra
$99.99 / month ($199.99 for 20×)
5× or 20× Pro's limits, 20 TB storage.
En date du 24 July 2026. OpenAI affiche des prix en euros pour l'Allemagne, Anthropic et Google en dollars — les deux devises apparaissent donc ici telles que chaque fournisseur les indique.
L’écart qui saute aux yeux : Claude n’a pas de palier intermédiaire bon marché. On passe directement du gratuit à 20 $. ChatGPT a Go à 8 €, Google AI Plus est à 4,99 $. Si tu utilises l’IA régulièrement mais pas professionnellement, Anthropic n’a tout simplement pas d’offre pour toi.
Dans l’autre sens : Claude Pro inclut Claude Code, l’outil de programmation, sans supplément. Ceux à qui ça parle le savent déjà.
Pourquoi ce texte a une date de péremption
Regarde le rythme.
OpenAI : GPT-5.1 en novembre 2025, 5.2 en décembre, 5.4 en mars 2026, 5.5 le 23 avril, 5.6 le 9 juillet. Cinq générations en huit mois.
Google : Gemini 3.5 Flash le 19 mai, Gemini 3.6 Flash le 21 juillet. Deux mois.
Ce que ça veut dire concrètement : un abonnement annuel n’est pas un pari sur un modèle, c’est un pari sur un fournisseur — le modèle que tu as choisi n’existera plus sous cette forme dans un an. Anthropic affiche 17 $ au lieu de 20 $ en facturation annuelle ; ce sont 36 $ d’économie contre l’impossibilité de changer d’avis pendant douze mois. Dans un domaine qui sort un nouveau modèle phare toutes les huit semaines, c’est le plus mauvais compromis.
Paie au mois. C’est le conseil le plus pratique de tout cet article.
Mon avis
Si tu en veux un et que tu préfères ne plus y penser : prends celui dont l’interface te gêne le moins. La différence de qualité affectera moins ton travail que le fait d’avoir envie ou non d’ouvrir la chose.
Si tu peux en payer deux, la combinaison sensée n’est pas « le meilleur plus le deuxième meilleur » — c’est un pour le texte et le code, un pour les médias — et sur cette deuxième place, Google est quasiment sans concurrence.
Et si dans trois mois tu te demandes à nouveau si tu as fait le bon choix : cet article aura été mis à jour d’ici là. L’historique des versions en bas te montre ce qui a changé.
Pour les outils autour des modèles — image, vidéo, musique, montage, automatisation — je tiens à jour, séparément et en continu, un index de 137 outils IA.
Sources
Tout vérifié le 24 juillet 2026.
- Tarifs de l’API Gemini — Google, tous les prix des modèles et fenêtres de contexte
- Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber — Google, 21 juillet 2026
- Google publie trois nouveaux modèles Gemini — mais pas de 3.5 Pro — TechCrunch, 21 juillet 2026
- Toutes les annonces de Google I/O 2026 — Google, 20 mai 2026
- Les abonnements IA de Google — Google, mai 2026
- La nouvelle famille GPT-5.6 : Luna, Terra, Sol — Simon Willison, 9 juillet 2026, avec les prix API et le contexte des benchmarks
- Forfaits et tarifs — Anthropic
Si quelque chose ici te semble dépassé ou faux : écris-moi. C’est exactement à ça que sert la date en haut de page.
Commentaires
Connecte-toi pour commenter, aimer et enregistrer. Se connecter →
Aucun commentaire pour l'instant. Écris le premier.