La pregunta llega casi siempre con la misma forma: «¿Cuál me conviene?». Y casi siempre quien pregunta espera un nombre.

Aquí no lo vas a encontrar. No por cobardía, sino porque desde hace más o menos un año la respuesta honesta es otra: en la mayoría de las tareas, la distancia entre los tres modelos punteros es menor que la distancia entre una pregunta bien planteada y una mal planteada. Y donde hay una diferencia clara, casi nunca está donde las tablas comparativas la buscan.

Así que esto no es un ranking. Es una decisión según la tarea — con fecha de referencia, porque este texto caduca.

Una aclaración

El primer borrador de este texto se escribió con Claude. Eso debe quedar sobre la mesa antes de que en cualquier parte de aquí se diga qué modelo hace mejor qué.

De ahí se siguen dos cosas. Primero, detrás de cada cifra hay una fuente que puedes abrir tú mismo — ninguna viene de una web comparativa, todas vienen de las páginas de precios y documentación de los propios proveedores, o de observadores identificados. Segundo, este artículo no corona a ningún ganador. Donde tengo una opinión, aparece marcada como tal.

Y: aquí no hay ningún enlace de afiliado. No podría haberlo — OpenAI, Anthropic y Google simplemente no tienen programas de partners. Lo cual, en este caso, simplifica bastante las cosas.

Qué hay disponible ahora mismo

What's available right now

ChatGPT OpenAI

GPT-5.6 Sol

Top model, coding and agents

$5 / $30 1.050.000 tokens 9 July 2026

Knowledge cutoff 16 February 2026 — anything later it only knows if it searches.

GPT-5.6 Terra

Everyday work

$2,50 / $15 1.050.000 tokens 9 July 2026

The model the free and Go tiers run on.

GPT-5.6 Luna

Fast and cheap

$1 / $6 1.050.000 tokens 9 July 2026

Claude Anthropic

Claude Fable 5

Strongest model, long-horizon work

$10 / $50 1.000.000 tokens 2026

Requires 30-day data retention — not available under zero data retention.

Claude Opus 4.8

Coding and agents

$5 / $25 1.000.000 tokens 2026

Claude Sonnet 5

Everyday work

$3 / $15 1.000.000 tokens 2026

Introductory price 2 / 10 until 31 August 2026.

Claude Haiku 4.5

Fast and cheap

$1 / $5 200.000 tokens 2025

The only model in this field without a million-token context.

Gemini Google

Gemini 3.6 Flash

Workhorse

$1,50 / $7,50 1.048.576 tokens 21 July 2026

17% cheaper on output than 3.5 Flash — Google's current default model.

Gemini 3.5 Flash

Predecessor, still available

$1,50 / $9 1.048.576 tokens 19 May 2026

Gemini 3.5 Flash-Lite

High-volume work

$0,30 / $2,50 1.048.576 tokens 21 July 2026

The cheapest output price in the whole field.

Gemini 3.1 Pro

Google's largest model — still labelled preview

$2–$4 / $12–$18 1.048.576 tokens 2026

Price rises above a 200,000-token prompt. The announced successor 3.5 Pro still hasn't shipped two months after the announcement.

Price per token says less than it promises: the models think for different lengths of time, and those thinking tokens are on the same bill. The cheaper model can be the more expensive job.

Fecha de referencia: 24 July 2026. Precios de lista en dólares estadounidenses, sin descuentos por procesamiento por lotes ni almacenamiento en caché — estos reducen la factura considerablemente en los tres casos. Consulta con el proveedor antes de tomar cualquier decisión.

Dos cosas llaman la atención al ponerlo todo uno al lado del otro.

La ventana de contexto ya no sirve como argumento. Durante dos años, «cuánto texto entra» fue el criterio más diferenciador. Hoy los tres rondan el millón de tokens — más o menos 700.000 palabras, varias novelas gordas de un tirón. Solo el modelo Claude más pequeño se sale de la fila con 200.000. Elegir hoy por la ventana de contexto es decidir según un criterio que los proveedores retiraron de la mesa hace tiempo.

El modelo más grande de Google lleva meses llamándose “preview”. El 19 de mayo, en su propia conferencia de desarrolladores, Google anunció un Gemini 3.5 Pro — «ya en uso interno», con lanzamiento «el mes que viene». El 21 de julio, dos meses después, llegaron en cambio tres modelos nuevos, y ninguno era el 3.5 Pro. El modelo disponible más potente de Google sigue llevando el número de versión 3.1 y la palabra “Preview” en el nombre. Todo lo demás en el catálogo es un modelo Flash — la clase rápida y barata.

No es un escándalo, pero sí un patrón: en los tres casos, lo que se anuncia y lo que realmente se puede contratar son dos listas distintas.

La decisión, según la tarea

Escribir código y trabajo largo y autónomo

Este es el más disputado — y los benchmarks no se contradicen entre sí, miden cosas distintas.

Claude Opus 4.8 lidera en SWE-Bench Pro (incidencias reales de GitHub) con un 69,2 %. GPT-5.6 Sol marca un nuevo máximo de 53,6 en «Agents’ Last Exam», bastante por delante de Claude Fable 5 en esa prueba. Gemini 3.5 Flash reporta un 76,2 % en Terminal-Bench 2.1. Tres exámenes, tres ganadores.

Simon Willison, que usa los tres a diario y lleva años escribiendo sobre ellos con cabeza fría, lo resumió así tras el lanzamiento de GPT-5.6: pese a las cifras récord, el modelo no le había parecido mejor que Claude Fable en tareas de programación complejas.

Mi consejo: aquí no decidas por el modelo, decide por las herramientas que lo rodean — lo bien que encaje con tu editor, tu terminal, tus hábitos. Los modelos están más cerca entre sí que los entornos en los que corren.

Imagen, vídeo, sonido

El único punto con una respuesta clara: Google.

Google es el único de los tres donde la generación de imagen y vídeo está en la misma lista de precios que los modelos de lenguaje — Veo 3.1 desde 0,05 $ por segundo de vídeo, Imagen 4 desde 0,02 $ por imagen. A eso se suma Gemini Omni, un modelo de vídeo que se puede editar a lo largo de varios turnos de conversación y que recuerda de qué se habló antes en la sesión.

Si tu tema son los medios, aquí no hay color.

Leer y resumir documentos largos

Da igual. De verdad que da igual. Ver arriba — los tres se tragan varios cientos de páginas de un tirón. Usa el que ya tengas abierto.

Muchas tareas pequeñas, automatizadas

Gemini 3.5 Flash-Lite tiene el precio de salida más barato de todo el campo, con 0,30 $ de entrada y 2,50 $ de salida por millón de tokens — un factor de dos a tres frente a los modelos pequeños de los otros dos.

Pero cuidado con esa cuenta; ver la siguiente sección.

Si ya vives dentro del ecosistema de Google

La entrada más barata del campo es Google AI Plus, con 4,99 $ — más 400 GB de almacenamiento de regalo. Y el plan de 19,99 $ de Google incluye YouTube Premium Lite.

Esa es la razón real por la que Google gana entre usuarios particulares, y no tiene nada que ver con la calidad del modelo. Si de todos modos ya pagas almacenamiento y YouTube, la IA sale casi gratis sobre el papel.

Si la protección de datos importa profesionalmente

Un detalle que no aparece en casi ninguna comparativa: el modelo más potente de Anthropic, Fable 5, exige 30 días de retención de datos y no está disponible en absoluto bajo retención cero. Si tu despacho, consulta o cliente exige justo eso, el modelo insignia queda descartado — y acabas en Opus 4.8, no en Fable.

Ese tipo de líneas vive en la documentación para desarrolladores, no en las páginas de producto.

Lo que los benchmarks no cuentan

El precio por token está roto como medida. Los modelos «piensan» antes de responder, y esos tokens de razonamiento van en la misma factura que la respuesta. Un modelo con la mitad de precio por token que razona el triple de tiempo sale más caro a fin de mes. Willison dice exactamente eso: la comparación en bruto de precio por token se ha vuelto engañosa. Quien de verdad quiera saber cuánto le cuesta algo tiene que pasar su tarea típica por los tres y mirar la factura — no la lista de precios.

Los exámenes los califican los examinados. Después de que los modelos de OpenAI quedaran por detrás de los de Anthropic en SWE-Bench Pro, OpenAI publicó una crítica de ese benchmark — con una estimación de que alrededor del 30 % de sus tareas están mal planteadas. Puede que sea del todo correcto en los hechos. Sigue siendo un testigo que declara en su propia causa. Y la misma cautela vale en sentido contrario: quien celebra un benchmark en el que va en cabeza está igual de interesado.

Y desde julio de 2026, el proveedor ya no decide solo cuándo sale un modelo. GPT-5.6 fue autorizado para su lanzamiento amplio solo después de una revisión completa por parte de un organismo del gobierno de EE. UU. — el Center for AI Standards and Innovation, dependiente del Departamento de Comercio. Eso dice más sobre los próximos años que cualquier porcentaje de este artículo.

Lo que cuesta

What it costs

ChatGPT OpenAI

ChatGPT Go

€8 / month

The cheap middle tier. Runs on Terra.

ChatGPT Plus

€23 / month

The plan most people mean. Free choice of model.

ChatGPT Pro

€229 / month

For constant use and Sol reasoning without a tight cap.

Claude Anthropic

Claude Pro

$20 / month ($17 billed annually)

Includes Claude Code. No cheaper middle tier exists.

Claude Max

from $100 / month ($200 for 20×)

5× or 20× Pro's usage limits. Same models.

Gemini Google

Google AI Plus

$4.99 / month

The cheapest entry in the field, incl. 400 GB storage.

Google AI Pro

$19.99 / month

Plus YouTube Premium Lite and storage — the bundle is the argument.

Google AI Ultra

$99.99 / month ($199.99 for 20×)

5× or 20× Pro's limits, 20 TB storage.

Fecha de referencia: 24 July 2026. OpenAI indica precios en euros para Alemania, mientras que Anthropic y Google los indican en dólares — por eso aquí aparecen ambas monedas tal como las expresa cada proveedor.

El hueco que salta a la vista: Claude no tiene un tramo intermedio barato. Pasa directo de gratis a 20 $. ChatGPT tiene Go a 8 €, Google AI Plus está en 4,99 $. Si usas la IA con regularidad pero no de forma profesional, Anthropic simplemente no tiene una oferta para ti.

Al revés: Claude Pro incluye Claude Code, la herramienta de programación, sin coste extra. A quien le importe, ya lo sabe.

Por qué este texto tiene fecha de caducidad

Fíjate en el ritmo.

OpenAI: GPT-5.1 en noviembre de 2025, 5.2 en diciembre, 5.4 en marzo de 2026, 5.5 el 23 de abril, 5.6 el 9 de julio. Cinco generaciones en ocho meses.

Google: Gemini 3.5 Flash el 19 de mayo, Gemini 3.6 Flash el 21 de julio. Dos meses.

Lo que eso significa en la práctica: un plan anual no es una apuesta por un modelo, es una apuesta por un proveedor — el modelo que elegiste no va a existir en esa forma dentro de un año. Anthropic anuncia 17 $ en vez de 20 $ si pagas anual; son 36 $ de ahorro a cambio de no poder cambiar de opinión durante doce meses. En un campo que saca un modelo insignia nuevo cada ocho semanas, es el peor trato.

Paga mes a mes. Es el consejo más práctico de todo este artículo.

Mi conclusión

Si quieres uno solo y prefieres dejar de pensarlo: coge el que menos te estorbe la interfaz. La diferencia de calidad va a afectar menos a tu trabajo que si te da gusto abrir la aplicación.

Si puedes pagar dos, la combinación sensata no es «el mejor más el segundo mejor» — es uno para texto y código, otro para medios — y en ese segundo puesto, Google está prácticamente sin rival.

Y si dentro de tres meses vuelves a preguntarte si elegiste bien: para entonces este artículo ya se habrá actualizado. El historial de versiones al final te muestra qué cambió.

Para las herramientas alrededor de los modelos — imagen, vídeo, música, edición, automatización — mantengo un índice de 137 herramientas de IA aparte, actualizado de forma continua.

Fuentes

Todo comprobado el 24 de julio de 2026.

Si algo aquí te parece desactualizado o incorrecto: escríbeme. Para eso está justo la fecha de arriba.