🔍 Transparencia total
No gano ninguna comisión con OpenAI, Anthropic ni Google: ninguna de las tres tiene programa de afiliados, así que aquí no te vendo nada. Este análisis está hecho con datos públicos verificados a julio de 2026 (webs oficiales, precios de API y benchmarks). Lo único que te ofrezco son mis manuales gratuitos de las tres para que aprendas a usarlas. Como ingeniero informático llevo meses programando a diario con las tres; esto es lo que veo.
El panorama en 2026: tres formas de programar con IA
En 2026, elegir IA para programar es elegir agente de código. Los tres grandes —OpenAI, Anthropic y Google— tienen su propio agente que va más allá de sugerir líneas: carga tu repositorio entero, ejecuta el terminal, depura y completa tareas de desarrollo de forma autónoma mientras tú haces otra cosa. La diferencia entre ellos es más pequeña de lo que parece por fuera, pero importa según tu caso.
El detonante de esta review es que OpenAI acaba de lanzar GPT-5.6 (9 de julio de 2026) con tres modelos —Luna, Terra y Sol— y su Codex ya corre sobre ellos. OpenAI afirma que su modelo tope, Sol, es "su mejor modelo de código" y que supera a Claude Fable 5 en el índice de agentes de código. Es un dato importante… y también una afirmación de la propia OpenAI, no una medición independiente. Vamos a ponerlo en contexto con las otras dos.
ChatGPT Codex: el agente de OpenAI (ahora con GPT-5.6)
ChatGPT Codex es el agente de programación de OpenAI integrado en ChatGPT. Con la llegada de GPT-5.6 pasa a apoyarse en tres modelos según la exigencia de la tarea: Luna (rápido y barato), Terra (equilibrado) y Sol (el más capaz, el que OpenAI llama su mejor modelo de código). Codex trabaja en un sandbox: le encargas la tarea, ejecuta, y te devuelve los cambios y los tests pasados.
Según el propio índice de OpenAI, Sol marca 80 puntos —2,8 por encima de Claude Fable 5— usando menos de la mitad de tokens de salida y tardando la mitad. Tómalo con la cautela de que es un benchmark del fabricante: en la práctica, la brecha entre los tres es estrecha y depende mucho del tipo de proyecto. Lo que sí es objetivo es que Codex es rapidísimo y muy sólido en bases de código grandes.
Datos clave de la comparativa
*En el índice de agentes de código de la propia OpenAI, sin verificación independiente.
Claude Code y Gemini: las otras dos grandes
Claude Code (Anthropic) es el agente que uso yo para publicar este mismo blog. Su modelo tope, Claude Fable 5, es la referencia en tareas de código largas y autónomas —refactors grandes, trabajo de horas sin corregirle—, con 1M de contexto. Es también el más caro por token ($10/$50 el millón), pero para trabajo agéntico serio muchos lo consideran el más fiable. Anthropic también ofrece modelos más baratos (Opus 4.8 a $5/$25, Sonnet 5 a $3/$15).
Gemini (Google), con su agente Antigravity, juega la carta del precio y la velocidad. Su Gemini 3.5 Flash ($1,50/$9 el millón) llega a batir a su propio 3.1 Pro en coding siendo un 25% más barato, y mantiene versión gratuita con cuota reducida. Es la opción más económica de las tres y la que mejor encaja si programas con presupuesto ajustado o dentro del ecosistema Google.
¿Para quién es cada una?
Aquí está el resumen honesto de a quién le conviene cada una, con mi manual gratuito de cada una para que empieces sin perderte:
ChatGPT Codex (GPT-5.6) Rápido
Para quien quiere el agente más rápido y con el mejor ecosistema, ya está en ChatGPT y trabaja monorepos grandes de maravilla. Ideal si ya pagas ChatGPT Plus. → Manual gratis de ChatGPT/Codex
Claude Code (Fable 5) Calidad
Para quien prioriza calidad y autonomía en tareas largas y no le importa pagar más por token. Es el que uso para este blog. → Manual gratis de Claude
Gemini 3.5 (Antigravity) Precio
Para quien busca el mejor precio y velocidad, empieza con presupuesto ajustado o vive en el ecosistema Google (Workspace, Cloud). → Manual gratis de Gemini
La diferencia entre las tres es más estrecha de lo que dice el marketing de cada una. La pregunta útil es "¿cuál es la mejor para lo que tú haces?".
En una frase, cada una
La más veloz y con el mejor ecosistema; recién actualizada con Sol, el modelo que OpenAI dice que lidera en coding. Mi nota: 8,8.
La referencia en tareas largas y autónomas; la más cara, pero la que yo uso para trabajo serio. Calidad por encima de precio.
La más barata y muy rápida; ideal para empezar o para el ecosistema Google. Relación precio-rendimiento imbatible.
ℹ️ Sobre los benchmarks
Cada empresa publica los benchmarks en los que gana. La ventaja de Sol sobre Fable 5 es medición de la propia OpenAI, aún sin verificación independiente. En proyectos reales la brecha entre las tres es pequeña: elige por precio, ecosistema y tipo de tarea, no por un punto de diferencia en un ranking.
Pros y contras de ChatGPT Codex (GPT-5.6)
Lo que funciona
- El agente más rápido de los tres, con gran ecosistema
- GPT-5.6 Sol: modelo de código puntero (según OpenAI)
- Excelente en monorepos y bases de código grandes
- Ya integrado en ChatGPT (si ya pagas Plus, lo tienes)
- Muy eficiente en tokens con Sol frente a la generación anterior
- Tres modelos (Luna/Terra/Sol) para ajustar coste a la tarea
Lo que hay que saber antes
- El plan Pro potente cuesta $100–200/mes
- La facturación por créditos-token se puede disparar con uso intensivo
- Su liderazgo en coding es un benchmark propio, no independiente
- Para tareas muy largas, muchos siguen prefiriendo Claude
- Sin programa de afiliados (a mí no me pagan por recomendarlo)
Comparativa: Codex vs Claude vs Gemini (precios reales, julio 2026)
| IA | Modelo tope | Precio API (in/out, por millón) | Contexto | Acceso desde | Para quién |
|---|---|---|---|---|---|
| ChatGPT Codex (OpenAI) | GPT-5.6 Sol | $5 / $30 | 1M | ChatGPT · $8–20/mes | Velocidad + ecosistema |
| Claude Code (Anthropic) | Claude Fable 5 | $10 / $50 | 1M | Claude · Pro/API | Calidad + tareas largas |
| Gemini (Google) | Gemini 3.5 Flash | $1,50 / $9 | 1M | Gratis / API barata | Precio + ecosistema Google |
Codex no tiene precio propio: va incluido en tu plan de ChatGPT (Free, Go $8, Plus $20, Pro $100–200, Business $25/usuario) y desde abril de 2026 se factura por créditos según los tokens que consumas, así que el gasto real depende de cuánto lo uses (para un desarrollador intensivo, ~$100–200/mes). Claude es el más caro por token pero muchos lo consideran el más fiable en trabajo autónomo largo; Gemini es el más barato y conserva versión gratuita. Confirma siempre los precios vigentes en la web oficial de cada uno.
¿Cuándo elegir cada una? Guía rápida de decisión
| Si tu prioridad es… | Tu IA | Por qué |
|---|---|---|
| Velocidad y monorepos grandes | ChatGPT Codex | El agente más rápido; brilla en bases de código enormes |
| Calidad y tareas autónomas largas | Claude Code | La referencia en trabajo de horas sin corregirle |
| Precio y empezar barato | Gemini 3.5 | La más económica y con versión gratuita |
| Ya pagas ChatGPT Plus | ChatGPT Codex | Lo tienes incluido, sin gasto extra |
| Ecosistema Google (Workspace/Cloud) | Gemini 3.5 | Integración nativa con tus herramientas |
Mi recomendación honesta
Si tuviera que elegir una para el uso más común hoy, sería ChatGPT Codex con GPT-5.6: es rapidísima, tiene el mejor ecosistema y acaba de dar un salto con Sol. Ahora bien, para el trabajo serio de este blog yo uso Claude Code, porque en tareas largas y autónomas me da más tranquilidad; y si estás empezando con poco presupuesto, Gemini 3.5 te da el 90% por una fracción del precio. La buena noticia es que puedes probar las tres —todas tienen entrada gratuita o barata— y quedarte con la que mejor encaje contigo.
Mi opinión resumida
La guerra de los agentes de código se ha vuelto tan reñida que elegir "la mejor" ya no tiene sentido; la pregunta correcta es cuál es la mejor para ti. OpenAI acaba de recuperar el foco con GPT-5.6 y su Codex es hoy la opción más rápida y con mejor ecosistema —mi nota, 8,8—. Anthropic mantiene la corona de la fiabilidad en tareas largas con Fable 5, y Google pelea con un precio que las otras dos no pueden igualar.
Como ingeniero que programa a diario con las tres, mi consejo es simple: no te cases con una por marketing. Elige por tu tipo de trabajo y tu presupuesto, empieza por la entrada gratuita, y cuando quieras sacarle partido de verdad, descarga mi manual de esa IA —son gratis y van al grano—.
Puntuación: mi valoración de ChatGPT Codex
Esta es la lectura de El Medidor, mi sistema de puntuación —aplicado a Codex con GPT-5.6, el protagonista de esta review—. La nota global sale de seis criterios; los datos y las críticas ya los has visto arriba, sin adornos.
De programar con IA a vivir de ella
Elegir bien la IA para programar es media batalla; la otra media es convertirla en ingresos. OpenAI no paga afiliación por Codex, así que recomendártelo no me deja nada: lo hago porque lo he probado. Si lo que buscas es dar el salto a vivir de la IA, la comunidad donde más gente en español he visto montar su agencia es La Tribu Divisual de Juan Pe Navarro. Soy alumno de pago: mentorías casi a diario y un método para conseguir clientes. No vendo curso propio; te enlazo el que uso.
Por Raúl Ramos