Volver al Blog

Codex en Claude Code: la guía del plugin oficial de OpenAI

10 de agosto de 20268 min de lectura·Nicolas Farchica

El plugin de Codex para Claude Code lo publica OpenAI, no la comunidad: vive en openai/codex-plugin-cc, salió el 30 de marzo de 2026 y ya acumula más de 31.000 estrellas. Si venís siguiendo cuándo usar CLAUDE.md, Skills, MCPs y Hooks o cómo funcionan los subagentes, esto es el mecanismo que faltaba: uno que trae un modelo de otro proveedor adentro de tu sesión.

No es un experimento de fin de semana. Es OpenAI publicando software para el harness de su competidor directo, con licencia Apache 2.0 y commits del mismo día en que escribo esto.

Acá te dejo qué hace cada comando, el detalle técnico del review gate que casi nadie cuenta, y cuándo conviene no instalarlo.

Aclaración antes de arrancar: el CHANGELOG oficial documenta solamente la versión 1.0.0, aunque el plugin ya va por la 1.0.6. No hay registro público de qué cambió entre medio, así que todo lo que sigue está verificado contra el código del repositorio, no contra las notas de versión.

Para qué sirve: que otro modelo revise lo que escribió el tuyo

El problema que resuelve es viejo y es humano. Un modelo que revisa su propio código arrastra los mismos supuestos que lo escribieron. Si Claude eligió mal una estrategia de caching, Claude va a mirar esa decisión con los ojos que la tomaron.

No es una cuestión de calidad de modelo. Es una cuestión de punto ciego.

El plugin corta ese círculo: escribís con Claude, revisás con Codex, y las dos pasadas ven el mismo diff con criterios distintos. La delegación de tareas — mandarle un bug a Codex mientras seguís en Claude — es el segundo caso de uso, no el primero.

Instalación: cuatro comandos y una cuenta de ChatGPT

Los requisitos reales son dos: Node.js 18.18 o superior, y acceso a Codex vía cuenta de ChatGPT (la capa gratuita sirve) o API key de OpenAI. El consumo va contra tus límites de Codex.

/plugin marketplace add openai/codex-plugin-cc
/plugin install codex@openai-codex
/reload-plugins
/codex:setup

/codex:setup te dice si Codex está instalado y logueado. Si falta y tenés npm, se ofrece a instalarlo. Si preferís hacerlo a mano: npm install -g @openai/codex, y después codex login.

Cuando termina, deberías ver los slash commands y el subagente codex:codex-rescue listado en /agents.

Los ocho comandos, y cuál te sirve en cada caso

ComandoQué haceModifica código
/codex:reviewReview estándar del working tree o de la ramaNo
/codex:adversarial-reviewReview steerable que cuestiona el diseñoNo
/codex:rescueDelega la tarea al subagente codex-rescue
/codex:transferConvierte la sesión actual en un thread de CodexNo
/codex:statusMuestra jobs corriendo y recientes del repoNo
/codex:resultTrae el output final de un job terminadoNo
/codex:cancelCancela un job en backgroundNo
/codex:setupVerifica instalación y administra el review gateNo

Los reviews aceptan --base <ref> para comparar contra una rama, más --wait y --background. Para cambios de varios archivos, background no es opcional en la práctica: el review tarda.

/codex:rescue es el único que toca código. Acepta --model y --effort, y tiene un atajo lindo: si escribís spark, el plugin lo mapea a gpt-5.3-codex-spark.

/codex:review --base main --background
/codex:rescue --model spark fix the issue quickly
/codex:status
/codex:result

review vs adversarial-review: el segundo discute la decisión, no el código

Esta es la distinción que más se malinterpreta, y está escrita en el propio repo.

/codex:review no es steerable. No toma texto de foco. Hace la revisión que haría /review corriendo dentro de Codex, y listo.

/codex:adversarial-review sí acepta texto libre después de los flags, y su trabajo es otro: presionar supuestos, tradeoffs, modos de falla y si otro enfoque hubiera sido más seguro o más simple.

/codex:adversarial-review --base main challenge whether this was the right caching and retry design

Uno te dice si el código está bien escrito. El otro te dice si había que escribirlo.

El review gate: un hook de Stop con timeout de 900 segundos

Acá está la parte que no vas a encontrar en las reseñas, porque hay que abrir hooks/hooks.json para verla.

El plugin registra tres hooks. SessionStart y SessionEnd tienen timeout de 5 segundos — livianos, sin riesgo. El tercero es otra cosa:

HookScriptTimeout
SessionStartsession-lifecycle-hook.mjs5 s
SessionEndsession-lifecycle-hook.mjs5 s
Stopstop-review-gate-hook.mjs900 s

Novecientos segundos son quince minutos. Cuando activás el gate con /codex:setup --enable-review-gate, cada vez que Claude intenta cerrar el turno se dispara un review de Codex, y si encuentra problemas bloquea el cierre para que Claude los resuelva primero.

OpenAI lo advierte en su propio README: puede generar un loop largo entre Claude y Codex y drenarte los límites de uso rápido. Recomiendan activarlo solo si vas a mirar la sesión de cerca.

Viene desactivado por defecto. Dejalo así hasta que sepas exactamente qué querés que audite.

El output no es prosa: es un contrato JSON con severidad y confianza

Otro detalle que se ve en el código y no en la documentación. El plugin define un JSON Schema para el resultado del review, con cuatro campos obligatorios: verdict, summary, findings y next_steps.

El verdict es un enum de dos valores: approve o needs-attention. Y cada finding obliga a declarar:

  • severity y confidence — qué tan grave, y qué tan seguro está
  • file, line_start, line_end — dónde exactamente
  • title, body y recommendation — qué pasa y qué hacer

Esto importa más de lo que parece. Un review que devuelve párrafos te obliga a leerlo entero para decidir si algo es urgente. Un review que devuelve severidad y confianza por hallazgo se puede ordenar, filtrar y automatizar.

El detalle que casi nadie mira: OpenAI escribió skills de Anthropic

El plugin incluye tres skills en el formato de Claude Code, con su frontmatter name / description y todo: codex-cli-runtime, codex-result-handling y gpt-5-4-prompting. Las tres están marcadas user-invocable: false — son contratos internos, no comandos para vos.

La tercera es la más interesante, porque es OpenAI documentando cómo hablarle a su propio modelo:

Prompt Codex like an operator, not a collaborator.

Y sigue: prompts compactos, estructurados en bloques con tags XML, declarando la tarea, el contrato de salida y las pocas restricciones que importan.

Si alguna vez dudaste de que el estilo de prompt cambia según el modelo, ahí tenés al proveedor diciéndolo por escrito.

Cuándo no instalarlo

No todo caso lo pide. Salteátelo si:

  • Trabajás solo con cambios de uno o dos archivos, donde el review propio alcanza
  • Tus límites de uso ya están ajustados: esto suma consumo de Codex encima del de Claude
  • Necesitás que el review corra en CI y no en tu terminal, porque el plugin es interactivo por diseño
  • No podés mandar tu código a un segundo proveedor por razones de compliance

Ese último punto no es menor y conviene resolverlo antes de instalar nada, no después.

Preguntas frecuentes

¿Qué es el plugin de Codex para Claude Code?

Es un plugin publicado por OpenAI en openai/codex-plugin-cc, bajo licencia Apache 2.0, que agrega ocho slash commands, un subagente y tres skills a Claude Code. Te permite lanzar reviews de código con Codex y delegarle tareas sin salir de la terminal donde ya estás trabajando.

¿Necesito pagar dos suscripciones para usarlo?

Necesitás acceso a Claude Code y, además, una cuenta de ChatGPT o una API key de OpenAI. El README oficial aclara que la capa gratuita de ChatGPT sirve, así que no hace falta pagar dos suscripciones, pero el uso consume tus límites de Codex. También requiere Node.js 18.18 o superior.

¿Qué diferencia hay entre /codex:review y /codex:adversarial-review?

Los dos son read-only y no modifican código. /codex:review hace una revisión estándar y no es steerable: no acepta texto de foco. /codex:adversarial-review sí lo acepta y está diseñado para cuestionar la decisión de diseño, no los detalles de implementación.

¿Es peligroso activar el review gate?

El propio README lo marca con un WARNING. El gate es un hook de tipo Stop con timeout de 900 segundos que corre un review antes de dejar cerrar el turno, y si encuentra problemas bloquea el cierre. Eso puede generar un loop entre Claude y Codex y consumir tus límites rápido. Viene desactivado por defecto.


Si estás armando un sistema donde varios agentes se revisan entre sí y querés discutir cómo encajarlo sin duplicar costos, escribime. Es el tipo de decisión que conviene pensar antes de instalar.

Nicolas Farchica

Nicolas Farchica

Especialista en Agentes de IA · Copenhague

Diseño e implemento agentes IA, MCP servers y harnesses en producción: el loop, las herramientas y el contexto que hacen que un modelo pase de contestar a trabajar. Todo lo que ves en este sitio está construido así.

Artículos relacionados