Codex en Claude Code: la guía del plugin oficial de OpenAI
En este artículo
El plugin de Codex para Claude Code lo publica OpenAI, no la comunidad: vive en openai/codex-plugin-cc, salió el 30 de marzo de 2026 y ya acumula más de 31.000 estrellas. Si venís siguiendo cuándo usar CLAUDE.md, Skills, MCPs y Hooks o cómo funcionan los subagentes, esto es el mecanismo que faltaba: uno que trae un modelo de otro proveedor adentro de tu sesión.
No es un experimento de fin de semana. Es OpenAI publicando software para el harness de su competidor directo, con licencia Apache 2.0 y commits del mismo día en que escribo esto.
Acá te dejo qué hace cada comando, el detalle técnico del review gate que casi nadie cuenta, y cuándo conviene no instalarlo.
Aclaración antes de arrancar: el CHANGELOG oficial documenta solamente la versión 1.0.0, aunque el plugin ya va por la 1.0.6. No hay registro público de qué cambió entre medio, así que todo lo que sigue está verificado contra el código del repositorio, no contra las notas de versión.
Para qué sirve: que otro modelo revise lo que escribió el tuyo
El problema que resuelve es viejo y es humano. Un modelo que revisa su propio código arrastra los mismos supuestos que lo escribieron. Si Claude eligió mal una estrategia de caching, Claude va a mirar esa decisión con los ojos que la tomaron.
No es una cuestión de calidad de modelo. Es una cuestión de punto ciego.
El plugin corta ese círculo: escribís con Claude, revisás con Codex, y las dos pasadas ven el mismo diff con criterios distintos. La delegación de tareas — mandarle un bug a Codex mientras seguís en Claude — es el segundo caso de uso, no el primero.
Instalación: cuatro comandos y una cuenta de ChatGPT
Los requisitos reales son dos: Node.js 18.18 o superior, y acceso a Codex vía cuenta de ChatGPT (la capa gratuita sirve) o API key de OpenAI. El consumo va contra tus límites de Codex.
/plugin marketplace add openai/codex-plugin-cc
/plugin install codex@openai-codex
/reload-plugins
/codex:setup
/codex:setup te dice si Codex está instalado y logueado. Si falta y tenés npm, se ofrece a instalarlo. Si preferís hacerlo a mano: npm install -g @openai/codex, y después codex login.
Cuando termina, deberías ver los slash commands y el subagente codex:codex-rescue listado en /agents.
Los ocho comandos, y cuál te sirve en cada caso
| Comando | Qué hace | Modifica código |
|---|---|---|
/codex:review | Review estándar del working tree o de la rama | No |
/codex:adversarial-review | Review steerable que cuestiona el diseño | No |
/codex:rescue | Delega la tarea al subagente codex-rescue | Sí |
/codex:transfer | Convierte la sesión actual en un thread de Codex | No |
/codex:status | Muestra jobs corriendo y recientes del repo | No |
/codex:result | Trae el output final de un job terminado | No |
/codex:cancel | Cancela un job en background | No |
/codex:setup | Verifica instalación y administra el review gate | No |
Los reviews aceptan --base <ref> para comparar contra una rama, más --wait y --background. Para cambios de varios archivos, background no es opcional en la práctica: el review tarda.
/codex:rescue es el único que toca código. Acepta --model y --effort, y tiene un atajo lindo: si escribís spark, el plugin lo mapea a gpt-5.3-codex-spark.
/codex:review --base main --background
/codex:rescue --model spark fix the issue quickly
/codex:status
/codex:result
review vs adversarial-review: el segundo discute la decisión, no el código
Esta es la distinción que más se malinterpreta, y está escrita en el propio repo.
/codex:review no es steerable. No toma texto de foco. Hace la revisión que haría /review corriendo dentro de Codex, y listo.
/codex:adversarial-review sí acepta texto libre después de los flags, y su trabajo es otro: presionar supuestos, tradeoffs, modos de falla y si otro enfoque hubiera sido más seguro o más simple.
/codex:adversarial-review --base main challenge whether this was the right caching and retry design
Uno te dice si el código está bien escrito. El otro te dice si había que escribirlo.
El review gate: un hook de Stop con timeout de 900 segundos
Acá está la parte que no vas a encontrar en las reseñas, porque hay que abrir hooks/hooks.json para verla.
El plugin registra tres hooks. SessionStart y SessionEnd tienen timeout de 5 segundos — livianos, sin riesgo. El tercero es otra cosa:
| Hook | Script | Timeout |
|---|---|---|
SessionStart | session-lifecycle-hook.mjs | 5 s |
SessionEnd | session-lifecycle-hook.mjs | 5 s |
Stop | stop-review-gate-hook.mjs | 900 s |
Novecientos segundos son quince minutos. Cuando activás el gate con /codex:setup --enable-review-gate, cada vez que Claude intenta cerrar el turno se dispara un review de Codex, y si encuentra problemas bloquea el cierre para que Claude los resuelva primero.
OpenAI lo advierte en su propio README: puede generar un loop largo entre Claude y Codex y drenarte los límites de uso rápido. Recomiendan activarlo solo si vas a mirar la sesión de cerca.
Viene desactivado por defecto. Dejalo así hasta que sepas exactamente qué querés que audite.
El output no es prosa: es un contrato JSON con severidad y confianza
Otro detalle que se ve en el código y no en la documentación. El plugin define un JSON Schema para el resultado del review, con cuatro campos obligatorios: verdict, summary, findings y next_steps.
El verdict es un enum de dos valores: approve o needs-attention. Y cada finding obliga a declarar:
severityyconfidence— qué tan grave, y qué tan seguro estáfile,line_start,line_end— dónde exactamentetitle,bodyyrecommendation— qué pasa y qué hacer
Esto importa más de lo que parece. Un review que devuelve párrafos te obliga a leerlo entero para decidir si algo es urgente. Un review que devuelve severidad y confianza por hallazgo se puede ordenar, filtrar y automatizar.
El detalle que casi nadie mira: OpenAI escribió skills de Anthropic
El plugin incluye tres skills en el formato de Claude Code, con su frontmatter name / description y todo: codex-cli-runtime, codex-result-handling y gpt-5-4-prompting. Las tres están marcadas user-invocable: false — son contratos internos, no comandos para vos.
La tercera es la más interesante, porque es OpenAI documentando cómo hablarle a su propio modelo:
Prompt Codex like an operator, not a collaborator.
Y sigue: prompts compactos, estructurados en bloques con tags XML, declarando la tarea, el contrato de salida y las pocas restricciones que importan.
Si alguna vez dudaste de que el estilo de prompt cambia según el modelo, ahí tenés al proveedor diciéndolo por escrito.
Cuándo no instalarlo
No todo caso lo pide. Salteátelo si:
- Trabajás solo con cambios de uno o dos archivos, donde el review propio alcanza
- Tus límites de uso ya están ajustados: esto suma consumo de Codex encima del de Claude
- Necesitás que el review corra en CI y no en tu terminal, porque el plugin es interactivo por diseño
- No podés mandar tu código a un segundo proveedor por razones de compliance
Ese último punto no es menor y conviene resolverlo antes de instalar nada, no después.
Preguntas frecuentes
¿Qué es el plugin de Codex para Claude Code?
Es un plugin publicado por OpenAI en openai/codex-plugin-cc, bajo licencia Apache 2.0, que agrega ocho slash commands, un subagente y tres skills a Claude Code. Te permite lanzar reviews de código con Codex y delegarle tareas sin salir de la terminal donde ya estás trabajando.
¿Necesito pagar dos suscripciones para usarlo?
Necesitás acceso a Claude Code y, además, una cuenta de ChatGPT o una API key de OpenAI. El README oficial aclara que la capa gratuita de ChatGPT sirve, así que no hace falta pagar dos suscripciones, pero el uso consume tus límites de Codex. También requiere Node.js 18.18 o superior.
¿Qué diferencia hay entre /codex:review y /codex:adversarial-review?
Los dos son read-only y no modifican código. /codex:review hace una revisión estándar y no es steerable: no acepta texto de foco. /codex:adversarial-review sí lo acepta y está diseñado para cuestionar la decisión de diseño, no los detalles de implementación.
¿Es peligroso activar el review gate?
El propio README lo marca con un WARNING. El gate es un hook de tipo Stop con timeout de 900 segundos que corre un review antes de dejar cerrar el turno, y si encuentra problemas bloquea el cierre. Eso puede generar un loop entre Claude y Codex y consumir tus límites rápido. Viene desactivado por defecto.
Si estás armando un sistema donde varios agentes se revisan entre sí y querés discutir cómo encajarlo sin duplicar costos, escribime. Es el tipo de decisión que conviene pensar antes de instalar.
Nicolas Farchica
Especialista en Agentes de IA · Copenhague
Diseño e implemento agentes IA, MCP servers y harnesses en producción: el loop, las herramientas y el contexto que hacen que un modelo pase de contestar a trabajar. Todo lo que ves en este sitio está construido así.
Artículos relacionados
Claude Buddy: Guía Completa del Tamagotchi de Claude Code (18 Especies y Rarezas)
Claude Buddy: las 18 especies, 5 rarezas, comandos /buddy y cómo conseguir un Shiny Legendary (0.01% de probabilidad). Guía completa en español.
Cómo Analicé 4 Videos de YouTube en Menos de 1 Hora con Claude Code (Caso Real)
Cómo uso Claude Code para bajar transcripciones de YouTube, analizarlas en paralelo, detectar patrones y construir una estrategia completa en menos del tiempo que tardaría en ver uno solo.
Anthropic se quedó con el Colossus 1 de SpaceX: qué cambia para usuarios Claude (mayo 2026)
Anthropic + SpaceX: rate limits de Claude Code ya subieron en Pro y Max. Datos verificados, qué cambia para vos y por qué el compute era el cuello.