Guía10 min

Claude Code vs Codex: comparativa para elegir tu agente de terminal en 2026

Resumen

Claude Code y Codex CLI comparten superficie de terminal, pero difieren en ecosistema, permisos, review sin escritura, skills y superficies extra. Esta guía compara ambos con tablas, protocolo de prueba de 60 minutos, matriz de decisión y FAQ para no mezclar dos CLIs como si fueran el mismo producto.

ClaudeOpenAI
Dos terminales en un escritorio real representando la elección entre Claude Code y Codex CLI

Qué resuelve

Esta pieza se queda en la decisión práctica: qué instalar, qué riesgo agrega y cómo aplicarlo sin romper operación.

Claude Code y Codex CLI se parecen desde lejos: abres una terminal, entras al repo y describes la tarea. Desde cerca, la decisión no es “qué modelo es más listo”, sino qué ecosistema ya pagas, cómo quieres aprobar comandos y si necesitas un CLI puro o varias superficies. Esta guía compara solo esos dos agentes de terminal —no Cursor, Copilot ni Gemini— con tablas, un protocolo de prueba y una matriz para decidir sin ranking eterno.

Si buscas un panorama de cinco herramientas, empieza por mejores agentes de código IA en 2026. Aquí el foco es el duelo entre los dos CLIs que más equipos hispanohablantes evalúan en paralelo.

Qué comparten (y por qué se confunden)

Ambos leen el repositorio local, editan archivos, ejecutan comandos y se extienden con MCP, skills y subagentes. Las docs oficiales los describen como herramientas agentic en la terminal, no como autocomplete del editor.

CapacidadClaude CodeCodex CLI
Superficie principalTerminal CLITerminal CLI
Instrucciones persistentes del repoCLAUDE.mdAGENTS.md (vía /init)
Extensión con MCPSí (codex mcp)
SubagentesSí (/agents, background agents)Sí (delegación en sesión)
Modo no interactivo / pipesSí (claude -p, CI)Sí (codex exec, scripts)
Reanudar sesionesSí (codex resume)
Skills reutilizablesSí (.claude/skills/)Sí (skills + plugins)

La confusión viene de ahí: misma forma de trabajo, distinto contrato de permisos, facturación y superficies extra.

Dónde se separan de verdad

Ecosistema y autenticación

Claude Code pide cuenta de Claude (plan Pro o Max) o API key de Anthropic Console. El mismo motor corre en terminal, extensiones de VS Code y JetBrains, app de escritorio y web (claude.ai/code), según la documentación de overview.

Codex CLI se instala con el instalador de ChatGPT y se autentica con tu cuenta de ChatGPT u otro método disponible en la región. OpenAI lo posiciona como el mismo agente que puedes llevar a la nube (codex cloud) o a CI con codex exec.

Regla práctica: no elijas por benchmarks ajenos; elige el ecosistema donde ya tienes suscripción, SSO o presupuesto de API aprobado.

Superficies más allá de la terminal

SuperficieClaude CodeCodex CLI
Solo terminal
Extensiones IDEVS Code, Cursor, JetBrainsNo (terminal-first)
App de escritorioSí (macOS, Windows)No
Web / móvilclaude.ai/code, remote controlcodex cloud desde terminal
Tareas programadasRoutines (nube), /loop, desktop scheduledScripts + codex exec en CI

Si tu día a día es solo terminal y scripts, el empate es real. Si quieres continuar la misma sesión en el IDE o en el móvil, Claude Code documenta más caminos oficiales hoy.

Review sin tocar el working tree

Aquí hay una diferencia operativa clara:

  • Codex documenta un modo review que analiza cambios sin modificar archivos: útil para revisar un diff, un commit o una rama base antes de fusionar.
  • Claude Code puede revisar código en conversación, pero su flujo por defecto es editar y ejecutar con aprobación. Para separar “quien escribe” de “quien audita”, en Codex el review dedicado es el camino más explícito.

En equipos que ya usan un agente para escribir, Codex review encaja como segunda pasada; Claude Code suele pedirte que seas explícito con el rol (“solo revisa, no edites”) o que uses otro harness.

Permisos y sandbox

Codex expone /permissions y documenta sandbox con raíces de escritura configurables; OpenAI publicó en mayo de 2026 una guía de operación segura con aprobaciones, políticas de red y telemetría agent-aware.

Claude Code usa aprobación de comandos, hooks (/hooks) y reglas en CLAUDE.md o settings del proyecto. Los hooks permiten correr linters o formateadores después de cada edición, algo que muchos equipos usan como red de seguridad blanda.

Ninguno es “seguro por defecto” si le das permisos amplios. La pregunta es qué tan granular quieres el panel de permisos frente a automatizar checks con hooks.

Dos flujos de terminal lado a lado: exploración del repo, edición y verificación de cambios

Tabla comparativa rápida

CriterioClaude CodeCodex CLIVentaja práctica
Instalación recomendadaScript nativo / Homebrew / WinGetInstalador chatgpt.com/codexEmpate; ambos evitan depender del gestor de paquetes del lenguaje
Instrucciones del repoCLAUDE.md, auto memoryAGENTS.mdEmpate conceptual; distinto nombre de archivo
Review sin escribirPosible con instrucción; no es modo dedicadoModo /review documentadoCodex para auditoría previa al merge
CI / automatizaciónclaude -p, GitHub Actionscodex exec, pipelinesCodex si ya vives en ChatGPT; Claude si ya facturas Anthropic
Plugins / marketplaceSkills + MCPPlugins + MCP (marketplace amplio)Codex si quieres catálogo tipo “instalar GitHub/Gmail” desde CLI
Búsqueda web en sesiónDepende de MCP / configuracióncodex --search nativoCodex para tareas con docs que cambian cada semana
Contexto visualMCP / capturas según setupcodex --image en el promptCodex para pegar screenshot de error o diagrama
Superficies extraIDE, desktop, web, Slack, ChromeCloud desde terminalClaude Code si el equipo no vive 100 % en terminal
Subagentes paralelosBackground agents, Agent SDKSubagentes en sesiónClaude Code si orquestas muchos workers documentados

Protocolo de 60 minutos (evidencia propia)

No elijas por un hilo de X. Corre la misma tarea en ambos CLIs y anota resultados.

Tarea canónica: en un repo real con tests, pide: “añade validación al endpoint X, cubre el caso vacío con un test y no toques otros módulos”.

PasoQué medirPasa si…
1. SetupMinutos hasta primer diff útilMenos de 25 min en la primera sesión
2. Alcancegit diff --stat1–4 archivos relacionados
3. Verificación¿Corrió el test?Comando y salida visibles en el transcript
4. PermisosComandos que pidió aprobarNada destructivo sin preguntar
5. ReviewSegunda pasada sin escribirCodex: /review; Claude: prompt “solo revisa”
6. RecuperaciónTiempo para deshacerMenos de 60 s con git o checkpoint

Plantilla:

Herramienta: Claude Code | Codex
Minutos hasta diff útil:
Archivos tocados:
Tests corridos (sí/no):
Comandos aprobados:
Review encontró algo (sí/no):
Decisión: diario | solo review | CI | descartar

Dos corridas bastan. La tercera solo si empatan en calidad pero fallan en dimensiones distintas (por ejemplo, Codex gana en review y Claude en IDE).

Matriz de decisión

Tu situaciónEligePor qué
Ya pagas Claude Pro/Max o API AnthropicClaude CodeMisma factura, mismas políticas de datos
Ya pagas ChatGPT Plus/Pro/TeamCodex CLIEl CLI hereda tu cuenta y plugins
Quieres auditoría local antes del commitCodexReview documentado sin escribir
Necesitas IDE + terminal + móvilClaude CodeSuperficies oficiales enlazadas
El pipeline es codex exec en CICodexDiseñado para scripting repetible
Quieres hooks post-edición (format, lint)Claude Code/hooks en el flujo diario
Investigas APIs que cambian cada releaseCodex--search con actividad visible
Construyes agentes custom con SDKClaude CodeAgent SDK sobre las mismas tools

No uses los dos para escribir en el mismo working tree a la vez. Uno edita; el otro, si acaso, revisa.

Revisión humana de un diff entre dos sesiones de agente, con checklist de aprobación

Errores comunes al compararlos

  1. Medir solo el modelo, no el harness. CLAUDE.md vs AGENTS.md, permisos y tests importan más que un punto en un benchmark ajeno.
  2. Ignorar la factura. Un CLI “gratis” con API key puede costar más que el plan que ya tienes.
  3. Mezclar superficies. Comparar Claude Code en VS Code contra Codex en terminal no es A/B limpio.
  4. Fusionar sin review. Ambos pueden producir diffs plausibles y incorrectos; el protocolo de 60 minutos existe para eso.
  5. Duplicar agentes escritores. Dos CLIs editando el mismo repo generan conflictos y ruido en Git.

Preguntas frecuentes

¿Puedo usar Claude Code y Codex en el mismo proyecto?

Sí, pero no en paralelo sobre el mismo working tree. Patrón sano: un agente implementa en una rama; el otro hace review sin escribir (Codex /review) o revisas tú el PR.

¿Cuál es mejor para principiantes?

El que ya tengas instalado y pagado. Ambos piden aprender permisos, git diff y tests. La guía de Claude Code desde cero cubre comandos y MCP si empiezas por Anthropic.

¿Necesito API key o basta la suscripción?

Claude Code acepta plan Claude o API key de Console. Codex se autentica con ChatGPT según la doc regional. Para CI, la API key o tokens de servicio suelen ser más estables que una sesión interactiva.

¿Cuál sirve mejor en CI?

Los dos tienen modo no interactivo. Codex documenta codex exec como primera clase; Claude Code documenta pipes con claude -p y acciones en GitHub/GitLab. Elige el que ya esté aprobado por tu equipo de plataforma.

¿Y si mi equipo usa Cursor o Copilot además?

Eso es otra capa. Cursor y Copilot son IDE o nube; esta guía es para el CLI en el repo. La regla sigue siendo una superficie escritora por cambio.

¿MCP cambia la comparación?

MCP nivela parte del terreno: ambos conectan herramientas externas. La diferencia queda en catálogo de plugins, permisos y cómo cada CLI expone las tools en el transcript.

¿Hay ganador absoluto en calidad de código?

No publicamos un podio: depende del repo, los tests y tus instrucciones. Por eso la matriz y el protocolo de 60 minutos pesan más que un benchmark genérico.

Próximo paso

  1. Elige el CLI acorde a tu factura y superficie (tabla de decisión).
  2. Corre el protocolo de 60 minutos en un repo con tests reales.
  3. Documenta en CLAUDE.md o AGENTS.md lo que aprendiste (estilo, comandos prohibidos, checklist de PR).

Para el marco más amplio —Cursor, Copilot cloud, Gemini CLI— vuelve al listado de agentes de código. Para cerrar otras decisiones de stack, el hub de comparativas ordena benchmarks y tradeoffs, y el curso gratuito te deja el bucle mínimo antes de escalar permisos.

Un CLI no es identidad de equipo. Es un contrato de permisos y verificación. Elige el que puedas auditar cada semana sin sorpresas.