Volver al Blog

Claude Opus 5.5: precio, benchmarks y guía de migración

22 de septiembre de 202613 min de lectura·Nicolas Farchica

Claude Opus 5.5 salió el 22 de septiembre de 2026. Es el primer modelo de la familia Claude 5.5 y ocupa el lugar de Opus 5 con una tarifa menor: $4 por millón de tokens de input y $20 de output, 20% menos que Opus 5 en ambos componentes.

Anthropic afirma que Opus 5.5 alcanza rendimiento de Fable 5.1 en la mayoría del trabajo con alrededor de 40% menos de costo en cargas típicas frente a Opus 5. Son estimaciones del proveedor y dependen del workload: sirven para formular la hipótesis, no para reemplazar una medición propia.

Y la migración no termina con cambiar el ID a claude-opus-5-5. Hay cuatro cambios incompatibles —thinking que no se puede desactivar, tools forzadas que devuelven error, thinking blocks ligados al modelo y a la conversación, y una tool de computer use que desaparece de dos plataformas— más una regla de compatibilidad nueva para quien rutea entre Opus, Fable y Mythos.

Si venís del análisis de lanzamiento de Opus 5, el contexto es directo: mismo lugar en la familia, mejor precio por token y una capa de migración más exigente que la de julio.

Qué cambió de verdad en Opus 5.5

La ficha técnica, según la documentación oficial:

  • ID en Claude API: claude-opus-5-5.
  • Contexto: 1M de tokens; salida sincrónica máxima de 128K.
  • Batch: salida de hasta 300K tokens, en beta.
  • Cutoff de conocimiento: junio de 2026.
  • Thinking: adaptive thinking siempre activo; el esfuerzo predeterminado pasa de high a medium.
  • Retiro: Anthropic no lo retirará antes del 22 de septiembre de 2027.
  • Disponibilidad: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS; Anthropic dice que está en todos los productos Claude.

Portada oficial del anuncio de lanzamiento de Claude Opus 5.5

Fuente: Anthropic — anuncio oficial de Claude Opus 5.5. Imagen oficial persistida sin recorte ni retoque.

El cambio de esfuerzo predeterminado de high a medium merece atención aparte: una integración que no fija el esfuerzo de forma explícita va a obtener un comportamiento distinto al que tenía con Opus 5 con el mismo código.

Opus 5.5, Opus 5 y Fable 5.1 en una tabla

AspectoClaude Opus 5.5Claude Opus 5Claude Fable 5.1
Contexto1M tokens1M tokens1M tokens
Salida sincrónica máxima128K tokens128K tokens128K tokens
Salida en Batch (beta)300K tokens
Input / output por MTok$4 / $20$5 / $25$10 / $50
Cache read por MTok$0,20$0,50$0,25
ThinkingAdaptativo, siempre activoAdaptativo, desactivableAdaptativo, siempre activo
Esfuerzo predeterminado en APImediumhighhigh

La foto completa de Fable 5.1 —por qué Anthropic lo mantiene para razonamiento exigente y agentes largos— está en el análisis de septiembre. Con Opus 5.5, la decisión entre los tres ya no es solo de capacidad: es de mezcla de precios y de costos de migración.

Precio por token no es costo por tarea

La tabla oficial de precios para Opus 5.5 en la Claude API:

ConceptoPrecio por MTok
Input$4
Output$20
Cache write de 5 minutos$5
Cache write de 1 hora$8
Cache read$0,20
Batch (input / output)$2 / $10
Fast (input / output)$8 / $40

Frente a Opus 5, input y output bajan 20% y el cache read baja 60%. Anthropic también declara una salida más de 30% más rápida.

Ninguno de esos números es "el costo de una tarea". El costo real de una tarea es la mezcla de tokens que consume: input nuevo, escrituras de caché, lecturas de caché, output y cantidad de turnos. Dos consecuencias prácticas:

  • Una carga que relee mucho contexto cacheado se beneficia del cache read a $0,20 más que una carga que manda contexto fresco en cada turno.
  • Una carga que genera mucho output paga $20 por MTok aunque el input haya bajado; el ahorro del 20% en input pesa poco si el 80% del gasto es salida.

Un ejemplo aritmético con las tarifas de lista lo hace tangible. Una tarea que envía 200K de input nuevo y genera 50K de output cuesta $1,80 con Opus 5.5 y $2,25 con Opus 5: 20% menos, exactamente la caída de la tarifa. Un agente que relee 500K de contexto cacheado por turno paga $0,10 por esa relectura con Opus 5.5 contra $0,25 con Opus 5: 60% menos en el componente que domina su factura. Ninguna carga real es pura: cada mezcla propia cae entre esos dos extremos.

Por eso la cifra de "40% menos en cargas típicas" es una estimación del proveedor sobre una mezcla de uso definida por Anthropic, no una promesa transferible. Antes de migrar, conviene medir en el flujo propio: input nuevo, cache writes, cache reads, output y turnos por tarea, antes y después, sobre el mismo conjunto de tareas.

El patrón ya se vio con Opus 5: la reducción relevante estaba en dónde se concentra el gasto de cada workload, no en el titular del precio.

Benchmarks: qué dice la tabla de Anthropic (y qué no dice)

Los números que Anthropic publicó el día del lanzamiento, en evaluaciones ejecutadas por el propio proveedor:

EvaluaciónOpus 5.5 (informado por Anthropic)
Terminal-Bench 4.066,4%
FrontierCode v1.1 Main54,4%
CursorBench 4.057,8%
GDPval-AA v2.11846
AutomationBench40,0%
HLE con tools67,7%
Terminal-Bench-Science58,7%
OSWorld 2.0 (partial)81,8%
Chartography con tools89,0%

Tres límites de método antes de sacar conclusiones:

  1. Son números del proveedor. Anthropic eligió las evaluaciones, las versiones y el harness. Evaluadores externos como Frontier Design y METR participaron de la evaluación prerelease, pero eso no convierte esta tabla en verificación independiente.
  2. No gana en todo, ni siquiera en la tabla propia. GPT-6 Astra reporta más en AutomationBench (41,4% contra 40,0%) y en Terminal-Bench-Science (64,6% contra 58,7%) dentro de la propia tabla de Anthropic.
  3. Los márgenes chicos predicen poco. Anthropic advierte que diferencias pequeñas entre modelos son menos predictivas de brechas reales en trabajo cotidiano. Y las ediciones de benchmark no son comparables entre sí: el GDPval-AA 1846 de esta tabla usa v2.1, una edición distinta a la v2 con la que se midió a Fable 5.1.

Algunas tareas de ciberseguridad pueden rutenarse a Opus 4.8 por las salvaguardas de producción, según documenta el proveedor. Eso afecta cómo leer cualquier benchmark de esa área: el número puede no reflejar solo al modelo evaluado.

Cuatro cambios incompatibles al migrar desde Opus 5

La guía oficial de migración identifica cuatro cambios que pueden romper una integración existente.

1. El thinking ya no se puede desactivar

Adaptive thinking está siempre activo en Opus 5.5. En Opus 5 podía desactivarse; ahora la integración debe presupuestar el razonamiento como parte del flujo, no como un modo opcional.

2. Forzar una tool devuelve error

La selección forzada de herramientas con tool_choice pasa a devolver error. Si la tool se forzaba para obtener salida estructurada, hay que validar el reemplazo adecuado antes del corte.

3. Los thinking blocks quedan ligados al modelo y a la conversación

Un thinking block queda asociado al modelo que lo generó y al prefijo de conversación que lo precede. Editar, reordenar o recortar ese prefijo rompe la ligadura. La integración debe tratar el historial como append-only.

4. computer_20251124 no está soportado en dos plataformas

La versión de computer use computer_20251124 no funciona en Claude API ni en Google Cloud. Quien dependa de esa tool en esas plataformas necesita una alternativa antes de migrar.

Un cambio silencioso más: el texto de progreso que aparecía entre tool calls pasa a vivir dentro de los thinking blocks. Si el cliente no pide explícitamente su visualización, ese texto desaparece sin error. Una UI que mostraba estado en vivo puede quedarse muda después de la migración sin que nada falle.

Compatibilidad de thinking: qué modelo lee qué

Para routers y cadenas de fallback, la regla nueva es direccional:

  • Opus 5.5 lee thinking blocks de Opus 5 y de modelos Opus, Sonnet y Haiku anteriores.
  • Opus 5.5 no lee thinking blocks de Fable ni de Mythos.
  • Fable 5.1 y Mythos 5.1 sí leen bloques generados por Opus 5.5, en la API de primera parte.

En la práctica, la dirección importa. Si una conversación baja de Opus 5.5 a un modelo anterior, ese modelo continúa sin los thinking blocks de 5.5. En cambio, en la API de primera parte, una cadena que pasa de Opus 5.5 a Fable 5.1 o Mythos 5.1 sí puede conservarlos. Si la conversación venía de Fable o Mythos hacia Opus 5.5, el razonamiento previo tampoco cruza. En todos los casos, el historial debe mantenerse append-only.

Seguridad, ZDR y marcas de agua

Lo que reporta la system card, con la atribución correspondiente:

  • Anthropic afirma el mejor resultado de auditoría conductual (behavioral audit) hasta la fecha.
  • Las capacidades evaluadas en biología y ciberseguridad son comparables a las de Mythos 5.1; las salvaguardas de biología son similares a las de Fable 5.1.
  • Las tareas de ciberseguridad pueden rutenarse a Opus 4.8, como se mencionó en la sección de benchmarks.
  • ZDR (Zero Data Retention) está disponible para Opus 5.5.
  • El watermarking de respuestas de Claude aplica.

Estas son evaluaciones y afirmaciones del proveedor sobre su propio modelo. Para un despliegue regulado, la verificación contractual —retención efectiva por workspace, región y plataforma— sigue siendo parte de la migración, no un anexo.

Migrar o quedarse: cómo decidir

La secuencia defendible es la misma de siempre, ahora con menos fricción de precio:

  1. Medir el costo por tarea real del workload con Opus 5: mezcla de tokens, turnos, latencia.
  2. Repetir la medición con Opus 5.5 en staging, con esfuerzo fijado de forma explícita (recordar que el default cambió a medium).
  3. Revisar los cuatro breaking changes contra el código: thinking, tool_choice, thinking blocks append-only, computer_20251124.
  4. Si hay router con Fable o Mythos, validar la dirección de los fallbacks según la compatibilidad de thinking.
  5. Comparar calidad, costo por tarea, latencia y tasa de intervención humana sobre el mismo conjunto de tareas, con ruta de reversión lista.

El timing también juega a favor de medir con calma: Anthropic no retirará Opus 5.5 antes del 22 de septiembre de 2027, y Opus 5 sigue disponible mientras tanto. No hay una ventana que obligue a cortar el primer día; hay una ventana para evaluar bien.

Migrar solo por el precio de lista traslada el riesgo de compatibilidad sin demostrar ahorro. Migrar con medición convierte el 20% del cartel en un número propio.

Checklist de migración

  • Cambiar el ID a claude-opus-5-5 en cada plataforma que se use; los identificadores cloud pueden diferir.
  • Eliminar todo intento de desactivar thinking; presupuestar su costo en el flujo.
  • Reemplazar tool_choice forzado y validar la alternativa elegida.
  • Auditar edición, reordenamiento y recorte de historial: la conversación debe ser append-only.
  • Verificar si se depende de computer_20251124 en Claude API o Google Cloud.
  • Pedir explícitamente la visualización del texto de progreso si la UI depende de él.
  • Fijar el esfuerzo de forma explícita; el default pasó de high a medium.
  • Validar la dirección de los fallbacks del router según qué modelo lee qué thinking.
  • Confirmar ZDR, retención, región y plataforma para despliegues regulados.
  • Medir costo por tarea, calidad, latencia e intervenciones antes y después, sobre las mismas tareas.
  • Dejar documentada la ruta de reversión a Opus 5 antes del corte.

Si la migración afecta un proceso crítico, la comparación debe correr sobre el mismo conjunto de tareas con criterios de aceptación definidos de antemano. Para armar esa evaluación, se puede iniciar una conversación.

Preguntas frecuentes y fuentes oficiales

¿Qué es Claude Opus 5.5 y cuándo se lanzó?

Es el primer modelo de la familia Claude 5.5, lanzado el 22 de septiembre de 2026. ID claude-opus-5-5, 1M de contexto, 128K de salida sincrónica, adaptive thinking siempre activo y esfuerzo predeterminado medium. Disponible en Claude API, Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS; Anthropic dice que llega a todos los productos Claude.

¿Cuánto cuesta Claude Opus 5.5?

$4 por MTok de input y $20 de output (20% menos que Opus 5). Cache read $0,20 (60% menos), cache write de 5 minutos $5, de 1 hora $8, Batch $2/$10 y Fast $8/$40. La estimación de 40% menos de costo en cargas típicas es del proveedor y depende de la mezcla de tokens del workload.

¿Qué se rompe al migrar desde Opus 5?

Cuatro cosas: thinking que no se puede desactivar, tool_choice forzado que devuelve error, thinking blocks ligados al modelo y a la conversación, y computer_20251124 sin soporte en Claude API ni Google Cloud. Además, el texto de progreso entre tool calls pasa a los thinking blocks y puede desaparecer en silencio.

¿Los benchmarks de Opus 5.5 son independientes?

No. Son evaluaciones del proveedor con su propio harness. Frontier Design y METR participaron de la evaluación prerelease, pero eso no es verificación independiente. En la propia tabla de Anthropic, GPT-6 Astra es más alto en AutomationBench y Terminal-Bench-Science, y Anthropic advierte que márgenes chicos predicen poco.

¿Opus 5.5 puede leer el thinking de Fable 5.1 o Mythos 5.1?

No. Lee thinking de Opus 5 y de Opus, Sonnet y Haiku anteriores. Fable 5.1 y Mythos 5.1 sí pueden leer los bloques de Opus 5.5 en la API de primera parte. El historial debe ser append-only.

Fuentes oficiales

Fuentes de Anthropic consultadas el 22 de septiembre de 2026:

Nicolas Farchica
Nicolas Farchica

Especialista en Agentes de IA · Copenhague

Diseño e implemento agentes IA, MCP servers y harnesses en producción: el loop, las herramientas y el contexto que hacen que un modelo pase de contestar a trabajar. Todo lo que ves en este sitio está construido así.

Artículos relacionados