Tres programas que escriben código por vos
Codex lo hace OpenAI. Claude Code lo hace Anthropic. OpenCode lo hace Anomaly, un equipo chico, y su código es abierto. Los tres resuelven el mismo problema y cobran de maneras muy distintas.
Codex, Claude Code y OpenCode hacen casi lo mismo y se parecen bastante poco. Esta página los compara sin elegir ganador, con foco en las aplicaciones de escritorio, que es donde entra la gente que no vive en la terminal.
Si nunca usaste ninguno de los tres, esta sección alcanza para seguir el resto de la página. Son cuarenta segundos de lectura.
GPT, Claude, Gemini, Qwen. Es lo que razona y redacta. Vive en un servidor y se cobra por la cantidad de texto que entra y sale, medido en tokens.
El programa que le da manos al modelo: abre tus archivos, los edita, corre comandos, mira el resultado y vuelve a intentar. Codex, Claude Code y OpenCode son agentes.
Dónde lo usás. Terminal, aplicación de escritorio, extensión del editor, navegador o teléfono. El mismo agente puede tener varias, y no todas hacen lo mismo.
Escribís una orden, el agente responde en la misma consola. Es la vía que los tres proyectos priorizan para automatizar, scriptear y correr en servidores.
La instalás, la abrís y le hablás en un chat. A la par ves los archivos, los cambios propuestos y una vista previa de lo que estás construyendo. Es el foco de esta comparativa.
Pensada para proyectar. Avanzá con las flechas del teclado, con los botones o tocando los puntitos.
Codex lo hace OpenAI. Claude Code lo hace Anthropic. OpenCode lo hace Anomaly, un equipo chico, y su código es abierto. Los tres resuelven el mismo problema y cobran de maneras muy distintas.
Hace tres años la IA te sugería la línea siguiente mientras escribías. Hoy le describís una tarea completa y la ejecuta sola: busca en el proyecto, cambia diez archivos, corre las pruebas y te avisa cuando terminó.
Los tres tienen las dos. En Codex y en Claude Code, el escritorio es hoy el producto principal.
Una ventana partida en paneles que acomodás como quieras: la conversación, el árbol de archivos, el diff con los cambios, una terminal, y un navegador chico donde se abre lo que estás construyendo para que el agente lo pruebe solo.
Es la primera bifurcación real. Codex y Claude Code vienen con el motor puesto por la casa y no se cambia. OpenCode no trae ninguno: enchufás la clave del proveedor que quieras, incluidos modelos que corren en tu propia máquina.
Para uso intensivo y sostenido, la cuota suele salir más barata. Para uso esporádico, el consumo gana con comodidad.
Los tres tienen niveles de permiso, desde pedirte autorización para cada comando hasta ejecutar sin preguntar. Claude Code los llama Manual, Aceptar ediciones, Plan, Auto y Bypass; desde el 7 de agosto de 2026, Auto viene puesto de fábrica en los planes pagos.
Cada conversación es una sesión con su propio contexto y sus propios cambios. Podés tener tres corriendo: una arreglando un bug, otra escribiendo pruebas, otra actualizando dependencias. Claude Code le da a cada una una copia aislada del proyecto para que no se pisen entre sí.
Los tres leen un archivo de texto en la raíz del proyecto donde escribís las reglas de la casa: cómo se corren las pruebas, qué convenciones se usan, qué no hay que tocar. Se llama CLAUDE.md en Claude Code y AGENTS.md en Codex y en OpenCode. Es lo que más mejora los resultados y casi nadie lo escribe.
Los tres proponen. La firma sigue siendo tuya.
— DIEGO PARRAS · CeMIACE FCE-UBA
Cada bloque flotante es un panel de la app de escritorio. Arrastrá para girar la escena, hacé clic en una columna para abrirla.
Cuatro vistas. Cada celda es un hecho verificable contra la documentación oficial de cada producto, con la fecha de corte del 13 de agosto de 2026.
| Criterio | Codex | Claude Code | OpenCode |
|---|
Incluye el episodio que más cambió el mapa: el bloqueo de acceso de terceros a las suscripciones de Claude. Está acá porque afecta directamente lo que podés hacer con OpenCode.
Sin ranking. La respuesta cambia según lo que ya pagás, cuánto te importa poder cambiar de motor y cómo preferís que te cobren.
Una comparación que no declara sus límites no es objetiva, es solo prolija. Estos son los de esta página.
Los puntajes que circulan (SWE-bench, Terminal-Bench) los informa cada proveedor, cambian todos los meses y se miden sobre tareas que no se parecen a tu trabajo. Poner un número en una tabla les da una autoridad que no tienen.
Codex cambió su forma de medir consumo en abril. Anthropic mantiene precios introductorios con fecha de vencimiento. Cualquier cifra de esta página vale para el 13 de agosto de 2026 y hay que revalidarla antes de decidir.
Los millones de desarrolladores semanales y las estrellas de GitHub los publica cada proyecto. Sirven para dimensionar la comunidad, no para inferir calidad.
Los tres tienen funciones sin equivalente del otro lado. Cuando una celda dice que algo no existe, quiere decir que no hay equivalente directo documentado, no que la herramienta sea peor.
Ninguno de estos datos surge de correr las tres herramientas sobre el mismo proyecto. Es una comparación documental de capacidades declaradas, no una prueba de campo.
El episodio de enero muestra algo estructural: en dos de los tres casos, la empresa que te vende el modelo también decide con qué programa podés usarlo, y puede cambiar de opinión sin aviso.
El borrador de esta comparativa se redactó con asistencia de un modelo de Anthropic, que es a la vez la empresa detrás de una de las tres herramientas comparadas. Por eso el criterio fue no emitir veredictos, incluir explícitamente los puntos en contra de Claude Code (dependencia de un solo proveedor de modelos, precio de los asientos de equipo, el bloqueo de enero) y dejar todas las fuentes primarias a la vista para que cualquiera pueda revisar cada afirmación.
Documentación oficial primero. Si algo de esta página contradice al enlace, ganá el enlace.