Claude Code vs Codex: comparativa para elegir tu agente de terminal en 2026
Resumen
Claude Code y Codex CLI comparten superficie de terminal, pero difieren en ecosistema, permisos, review sin escritura, skills y superficies extra. Esta guía compara ambos con tablas, protocolo de prueba de 60 minutos, matriz de decisión y FAQ para no mezclar dos CLIs como si fueran el mismo producto.

Qué resuelve
Esta pieza se queda en la decisión práctica: qué instalar, qué riesgo agrega y cómo aplicarlo sin romper operación.
Claude Code y Codex CLI se parecen desde lejos: abres una terminal, entras al repo y describes la tarea. Desde cerca, la decisión no es “qué modelo es más listo”, sino qué ecosistema ya pagas, cómo quieres aprobar comandos y si necesitas un CLI puro o varias superficies. Esta guía compara solo esos dos agentes de terminal —no Cursor, Copilot ni Gemini— con tablas, un protocolo de prueba y una matriz para decidir sin ranking eterno.
Si buscas un panorama de cinco herramientas, empieza por mejores agentes de código IA en 2026. Aquí el foco es el duelo entre los dos CLIs que más equipos hispanohablantes evalúan en paralelo.
Qué comparten (y por qué se confunden)
Ambos leen el repositorio local, editan archivos, ejecutan comandos y se extienden con MCP, skills y subagentes. Las docs oficiales los describen como herramientas agentic en la terminal, no como autocomplete del editor.
| Capacidad | Claude Code | Codex CLI |
|---|---|---|
| Superficie principal | Terminal CLI | Terminal CLI |
| Instrucciones persistentes del repo | CLAUDE.md | AGENTS.md (vía /init) |
| Extensión con MCP | Sí | Sí (codex mcp) |
| Subagentes | Sí (/agents, background agents) | Sí (delegación en sesión) |
| Modo no interactivo / pipes | Sí (claude -p, CI) | Sí (codex exec, scripts) |
| Reanudar sesiones | Sí | Sí (codex resume) |
| Skills reutilizables | Sí (.claude/skills/) | Sí (skills + plugins) |
La confusión viene de ahí: misma forma de trabajo, distinto contrato de permisos, facturación y superficies extra.
Dónde se separan de verdad
Ecosistema y autenticación
Claude Code pide cuenta de Claude (plan Pro o Max) o API key de Anthropic Console. El mismo motor corre en terminal, extensiones de VS Code y JetBrains, app de escritorio y web (claude.ai/code), según la documentación de overview.
Codex CLI se instala con el instalador de ChatGPT y se autentica con tu cuenta de ChatGPT u otro método disponible en la región. OpenAI lo posiciona como el mismo agente que puedes llevar a la nube (codex cloud) o a CI con codex exec.
Regla práctica: no elijas por benchmarks ajenos; elige el ecosistema donde ya tienes suscripción, SSO o presupuesto de API aprobado.
Superficies más allá de la terminal
| Superficie | Claude Code | Codex CLI |
|---|---|---|
| Solo terminal | Sí | Sí |
| Extensiones IDE | VS Code, Cursor, JetBrains | No (terminal-first) |
| App de escritorio | Sí (macOS, Windows) | No |
| Web / móvil | claude.ai/code, remote control | codex cloud desde terminal |
| Tareas programadas | Routines (nube), /loop, desktop scheduled | Scripts + codex exec en CI |
Si tu día a día es solo terminal y scripts, el empate es real. Si quieres continuar la misma sesión en el IDE o en el móvil, Claude Code documenta más caminos oficiales hoy.
Review sin tocar el working tree
Aquí hay una diferencia operativa clara:
- Codex documenta un modo review que analiza cambios sin modificar archivos: útil para revisar un diff, un commit o una rama base antes de fusionar.
- Claude Code puede revisar código en conversación, pero su flujo por defecto es editar y ejecutar con aprobación. Para separar “quien escribe” de “quien audita”, en Codex el review dedicado es el camino más explícito.
En equipos que ya usan un agente para escribir, Codex review encaja como segunda pasada; Claude Code suele pedirte que seas explícito con el rol (“solo revisa, no edites”) o que uses otro harness.
Permisos y sandbox
Codex expone /permissions y documenta sandbox con raíces de escritura configurables; OpenAI publicó en mayo de 2026 una guía de operación segura con aprobaciones, políticas de red y telemetría agent-aware.
Claude Code usa aprobación de comandos, hooks (/hooks) y reglas en CLAUDE.md o settings del proyecto. Los hooks permiten correr linters o formateadores después de cada edición, algo que muchos equipos usan como red de seguridad blanda.
Ninguno es “seguro por defecto” si le das permisos amplios. La pregunta es qué tan granular quieres el panel de permisos frente a automatizar checks con hooks.

Tabla comparativa rápida
| Criterio | Claude Code | Codex CLI | Ventaja práctica |
|---|---|---|---|
| Instalación recomendada | Script nativo / Homebrew / WinGet | Instalador chatgpt.com/codex | Empate; ambos evitan depender del gestor de paquetes del lenguaje |
| Instrucciones del repo | CLAUDE.md, auto memory | AGENTS.md | Empate conceptual; distinto nombre de archivo |
| Review sin escribir | Posible con instrucción; no es modo dedicado | Modo /review documentado | Codex para auditoría previa al merge |
| CI / automatización | claude -p, GitHub Actions | codex exec, pipelines | Codex si ya vives en ChatGPT; Claude si ya facturas Anthropic |
| Plugins / marketplace | Skills + MCP | Plugins + MCP (marketplace amplio) | Codex si quieres catálogo tipo “instalar GitHub/Gmail” desde CLI |
| Búsqueda web en sesión | Depende de MCP / configuración | codex --search nativo | Codex para tareas con docs que cambian cada semana |
| Contexto visual | MCP / capturas según setup | codex --image en el prompt | Codex para pegar screenshot de error o diagrama |
| Superficies extra | IDE, desktop, web, Slack, Chrome | Cloud desde terminal | Claude Code si el equipo no vive 100 % en terminal |
| Subagentes paralelos | Background agents, Agent SDK | Subagentes en sesión | Claude Code si orquestas muchos workers documentados |
Protocolo de 60 minutos (evidencia propia)
No elijas por un hilo de X. Corre la misma tarea en ambos CLIs y anota resultados.
Tarea canónica: en un repo real con tests, pide: “añade validación al endpoint X, cubre el caso vacío con un test y no toques otros módulos”.
| Paso | Qué medir | Pasa si… |
|---|---|---|
| 1. Setup | Minutos hasta primer diff útil | Menos de 25 min en la primera sesión |
| 2. Alcance | git diff --stat | 1–4 archivos relacionados |
| 3. Verificación | ¿Corrió el test? | Comando y salida visibles en el transcript |
| 4. Permisos | Comandos que pidió aprobar | Nada destructivo sin preguntar |
| 5. Review | Segunda pasada sin escribir | Codex: /review; Claude: prompt “solo revisa” |
| 6. Recuperación | Tiempo para deshacer | Menos de 60 s con git o checkpoint |
Plantilla:
Herramienta: Claude Code | Codex
Minutos hasta diff útil:
Archivos tocados:
Tests corridos (sí/no):
Comandos aprobados:
Review encontró algo (sí/no):
Decisión: diario | solo review | CI | descartar
Dos corridas bastan. La tercera solo si empatan en calidad pero fallan en dimensiones distintas (por ejemplo, Codex gana en review y Claude en IDE).
Matriz de decisión
| Tu situación | Elige | Por qué |
|---|---|---|
| Ya pagas Claude Pro/Max o API Anthropic | Claude Code | Misma factura, mismas políticas de datos |
| Ya pagas ChatGPT Plus/Pro/Team | Codex CLI | El CLI hereda tu cuenta y plugins |
| Quieres auditoría local antes del commit | Codex | Review documentado sin escribir |
| Necesitas IDE + terminal + móvil | Claude Code | Superficies oficiales enlazadas |
El pipeline es codex exec en CI | Codex | Diseñado para scripting repetible |
| Quieres hooks post-edición (format, lint) | Claude Code | /hooks en el flujo diario |
| Investigas APIs que cambian cada release | Codex | --search con actividad visible |
| Construyes agentes custom con SDK | Claude Code | Agent SDK sobre las mismas tools |
No uses los dos para escribir en el mismo working tree a la vez. Uno edita; el otro, si acaso, revisa.

Errores comunes al compararlos
- Medir solo el modelo, no el harness.
CLAUDE.mdvsAGENTS.md, permisos y tests importan más que un punto en un benchmark ajeno. - Ignorar la factura. Un CLI “gratis” con API key puede costar más que el plan que ya tienes.
- Mezclar superficies. Comparar Claude Code en VS Code contra Codex en terminal no es A/B limpio.
- Fusionar sin review. Ambos pueden producir diffs plausibles y incorrectos; el protocolo de 60 minutos existe para eso.
- Duplicar agentes escritores. Dos CLIs editando el mismo repo generan conflictos y ruido en Git.
Preguntas frecuentes
¿Puedo usar Claude Code y Codex en el mismo proyecto?
Sí, pero no en paralelo sobre el mismo working tree. Patrón sano: un agente implementa en una rama; el otro hace review sin escribir (Codex /review) o revisas tú el PR.
¿Cuál es mejor para principiantes?
El que ya tengas instalado y pagado. Ambos piden aprender permisos, git diff y tests. La guía de Claude Code desde cero cubre comandos y MCP si empiezas por Anthropic.
¿Necesito API key o basta la suscripción?
Claude Code acepta plan Claude o API key de Console. Codex se autentica con ChatGPT según la doc regional. Para CI, la API key o tokens de servicio suelen ser más estables que una sesión interactiva.
¿Cuál sirve mejor en CI?
Los dos tienen modo no interactivo. Codex documenta codex exec como primera clase; Claude Code documenta pipes con claude -p y acciones en GitHub/GitLab. Elige el que ya esté aprobado por tu equipo de plataforma.
¿Y si mi equipo usa Cursor o Copilot además?
Eso es otra capa. Cursor y Copilot son IDE o nube; esta guía es para el CLI en el repo. La regla sigue siendo una superficie escritora por cambio.
¿MCP cambia la comparación?
MCP nivela parte del terreno: ambos conectan herramientas externas. La diferencia queda en catálogo de plugins, permisos y cómo cada CLI expone las tools en el transcript.
¿Hay ganador absoluto en calidad de código?
No publicamos un podio: depende del repo, los tests y tus instrucciones. Por eso la matriz y el protocolo de 60 minutos pesan más que un benchmark genérico.
Próximo paso
- Elige el CLI acorde a tu factura y superficie (tabla de decisión).
- Corre el protocolo de 60 minutos en un repo con tests reales.
- Documenta en
CLAUDE.mdoAGENTS.mdlo que aprendiste (estilo, comandos prohibidos, checklist de PR).
Para el marco más amplio —Cursor, Copilot cloud, Gemini CLI— vuelve al listado de agentes de código. Para cerrar otras decisiones de stack, el hub de comparativas ordena benchmarks y tradeoffs, y el curso gratuito te deja el bucle mínimo antes de escalar permisos.
Un CLI no es identidad de equipo. Es un contrato de permisos y verificación. Elige el que puedas auditar cada semana sin sorpresas.
Lecturas relacionadas
Sigue explorando Coding Agents y otras piezas para builders.

git status para coding agents: porcelain, XY, no el long

Reusable workflows: workflow_call, no copies el YAML entre repos

schedule (cron) en GitHub Actions: UTC, no cada minuto
