Si vas a programar o a construir cosas con IA y dudas entre GPT-5 y Claude, la respuesta corta es esta: Claude gana en el trabajo difícil de verdad, GPT-5 con Codex es más barato y muchos lo usan a diario por comodidad, y los que van en serio acaban usando los dos. Yo construyo las herramientas internas de mis dos empresas con IA, así que aquí te cuento dónde está cada uno de verdad, con datos y con lo que veo.
Qué estás comparando
Por el lado de Claude, el modelo tope es Opus 4.8, que es el que mueve Claude Code por defecto. Por el lado de OpenAI, GPT-5 es el modelo, y Codex es la herramienta que lo ejecuta (en terminal, en el editor y en la nube), con variantes afinadas para código. Las versiones cambian cada pocas semanas, así que no te cases con el número, quédate con la relación.
Los benchmarks, sin humo
En las pruebas fáciles ya están los dos empatados por arriba, rondando el 85-90%, así que esa cifra ya no distingue. Donde se ve la diferencia es en lo difícil: en las pruebas de código multi-fichero, las que se parecen a un proyecto real, Claude saca ventaja de forma consistente. En cambio, en tareas de terminal y DevOps, Codex de OpenAI manda. Y Codex gasta bastantes menos tokens por tarea, o sea que estira más el dólar.
Un aviso honesto: ningún benchmark público es una comparación limpia, porque el resultado cambia según cómo lo montes. Tómalos como dirección, no como sentencia.
La paradoja que lo explica todo
Hay un dato de una encuesta a más de 500 desarrolladores que lo resume perfecto. Cuando comparan la calidad a ciegas, gana Claude Code (alrededor de dos de cada tres lo prefieren). Pero cuando les preguntas qué usan cada día, muchos tiran de Codex, por comodidad y por coste. La frase que se repite: Claude es de más calidad, Codex es algo peor pero más usable en el día a día.
Traducido: si te importa que acierte en lo complicado, Claude. Si te importa el volumen y el precio, Codex. Por eso los profesionales usan los dos y enrutan según la tarea.
Cómo lo uso yo
Para programar y construir, mi postura es clara: Claude Code. Con ella he montado la plataforma B2B de Barner, un gestor de activos digitales, un CRM propio conectado a nuestro ERP para dejar de pagar HubSpot, y un puñado de cosas más que sin ella no habría construido. Nada de esto lo habría hecho antes contratando a un equipo de desarrollo, ni se me habría pasado por la cabeza.
He usado Codex también, sobre todo cuando se me acababan los tokens de Claude Code, y me ha resuelto bien. No lo desprecio. Pero aquí viene lo importante para decidir.
El detalle que casi nadie te cuenta: el contexto no se comparte
Las sesiones de Codex y las de Claude no se hablan entre sí. Cada una lleva su propio fichero de instrucciones (uno usa CLAUDE.md, el otro AGENTS.md) y su propio hilo. Si empiezas algo en una y quieres seguirlo en la otra, tienes que pasarte la información a mano con documentos. Y ojo, que esto también pasa entre las propias sesiones de Claude Code según dónde la abras (terminal, escritorio, dentro de VS Code).
Por eso mi consejo es hacerlo todo en una sola herramienta. No por fanatismo, sino porque saltar de una a otra te hace empezar de cero cada vez y pierdes el contexto, que es justo lo que da calidad al resultado. Cuando eliges una y montas tu sistema a fondo encima (tus ficheros de instrucciones, tus skills, tu manera de trabajar), la herramienta rinde el doble. En mi caso esa herramienta es Claude Code.
Qué alaba y qué critica la gente
De Claude para código, alaban que entiende lo que quieres decir, no solo lo que escribes, que aguanta refactors grandes sin perder el hilo y que gestiona bien el contexto guardando a fichero en vez de truncar. La pega número uno son los límites de uso, que con el modelo tope se agotan rápido.
De GPT-5 y Codex, alaban que sigue las instrucciones al pie de la letra, que gasta menos y que es consistente sesión a sesión. La crítica es que a veces es demasiado literal: le pides una cosa y hace exactamente eso aunque no tuviera sentido, sin inferir lo que de verdad buscabas.
Cuál elegir
Si construyes software o automatizaciones serias y quieres que acierte en lo difícil, Claude Code. Si te pesa más el coste, el volumen y la autonomía para tareas de terminal, Codex. Si te lo puedes permitir, ten las dos y usa cada una para lo suyo.
Pero elige una como tu casa y móntala bien. Ahí está la diferencia entre jugar con la IA y construir con ella. Si quieres aprender a hacerlo paso a paso, en la academia de Digital Brain enseño cómo monto estos sistemas en mis empresas. Y cada día te resumo lo que importa en IA en digitalbrain.email.
Relacionado


