Anthropic lanzó Claude Opus 5.5 el 22 de septiembre. Afirma que rinde casi al nivel de Fable 5.1 en la mayoría de las tareas, a un precio inferior al de Opus 5.

Para los equipos que ya usan Opus 5, la actualización va más allá de un identificador de modelo más barato. Opus 5.5 siempre usa razonamiento adaptativo, viene configurado con un nivel medio de forma predeterminada y rechaza varias estructuras de solicitud que Opus 5 aceptaba. También se sitúa por debajo de Fable 5.1: Anthropic lo recomienda como modelo diario para el trabajo supervisado y reserva Fable para las tareas autónomas más difíciles y prolongadas.

El cambio de fondo

  • Qué ha cambiado: Opus 5.5 reduce un 20 % las tarifas de entrada y salida, y un 60 % las de lectura de caché. El razonamiento adaptativo siempre activado también cambia cómo deben solicitarse y presupuestarse las tareas en los clientes de API existentes.
  • Por qué importa: Las tareas largas de agentes vuelven a leer las instrucciones y los resultados de herramientas anteriores. El mayor recorte de precio se aplica a ese contexto reutilizado, por lo que el uso de caché es clave para entender la factura total de una tarea.
  • Qué conviene observar: Anthropic ha anunciado Sonnet 5.5 y Haiku 5.5 para las próximas semanas; Opus es el primero disponible. Elegir un modelo predeterminado exige comparar el coste de las tareas completadas y el nivel de revisión que requiere cada opción.

Opus 5.5 está pensado para el trabajo de producción por debajo del nivel de Fable

La recomendación de Anthropic para socios sitúa Opus 5.5 como opción empresarial predeterminada para programación de producción y trabajo especializado en finanzas, asuntos jurídicos y agentes. Su guía pública para elegir modelos indica que la mayoría de las cargas de trabajo empiezan con Opus 5.5 y lo asocia con la programación compleja de agentes y el trabajo empresarial. Otra guía sobre costes lo describe como un «modelo de uso diario» para el desarrollo supervisado de funciones, la depuración y la revisión de código. Ambas guías sitúan Fable 5.1 por encima cuando importa más la mayor capacidad disponible o una ejecución larga y difícil que el precio por token.

La guía para redactar instrucciones de Anthropic respalda esa amplitud con pruebas de la empresa en análisis de causas raíz, revisión de código, subagentes paralelos, investigación, hojas de cálculo, informes y presentaciones. También describe mensajes de progreso y resúmenes finales más claros, además de mejoras en visión y uso del ordenador. Son evaluaciones de Anthropic, no pruebas realizadas por BIG CHANGE.

La diferencia entre Opus y Fable importa porque Fable 5.1 cuesta 10 dólares por millón de tokens de entrada y 50 por millón de salida, frente a 4 y 20 dólares para Opus 5.5. Las tarifas de lectura de caché están mucho más cerca: 0,25 y 0,20 dólares. Por tanto, en sesiones largas con caché, la diferencia de precio puede ser menor de lo que sugieren las tarifas principales de entrada y salida.

Claude Opus 5.5 modifica cuatro tarifas de API

Los precios estándar de API que aparecen a continuación son por millón de tokens. La referencia del modelo de Anthropic indica que Opus 5.5 tiene una ventana de contexto de un millón de tokens y un máximo de salida de 128.000 tokens. Su documentación de precios indica que se aplican las tarifas estándar en toda la ventana de contexto.

Cargo de API

Opus 5.5

Opus 5

Cambio

Entrada

$4

$5

20 % menos

Salida

$20

$25

20 % menos

Escritura en caché de 5 minutos

$5

$6,25

20 % menos

Lectura de caché

$0,20

$0,50

60 % menos

Anthropic informa de que el coste típico de una tarea es un 40 % menor con la configuración predeterminada; el cálculo combina tarifas y eficiencia en el uso de tokens. Su explicación del coste por tarea muestra por qué importa la combinación: las sesiones largas de agentes vuelven a leer el contexto creciente, la salida incluye tokens de razonamiento y una tarea puede constar de muchos turnos. Una reducción del 60 % en la lectura de caché puede dominar el coste de una sesión que depende mucho de la caché, mientras que una solicitud breve sin caché y con una respuesta larga se acerca más al recorte del 20 % en la tarifa de salida.

La mejora comunicada, de más del 30 %, corresponde a la velocidad de generación de salida, según la guía de instrucciones. No mide el tiempo dedicado a esperar herramientas, pruebas, servicios externos o a una persona revisora. Anthropic también ofrece un modo de API más rápido, a 8 dólares de entrada y 40 de salida por millón de tokens, en versión preliminar de investigación para la API de Claude, pero no para las plataformas de nube asociadas.

Anthropic también aumentó los límites de cinco horas en los planes Pro, Max, Team y Enterprise por puesto, y habilitó reinicios de límites con capacidad acumulable. La capacidad de las suscripciones es independiente de la facturación de API.

Las pruebas comparativas de la empresa muestran fortalezas y límites

Anthropic informa de puntuaciones en Terminal-Bench 4.0 de 66,4 % para Opus 5.5 con Xhigh, 52,3 % para Opus 5 y 55,8 % para Fable 5.1. La mayoría de los demás resultados destacados se obtuvieron con el esfuerzo Max.

GPT-6 Astra lidera las filas mostradas de AutomationBench y Terminal-Bench-Science. Las tareas de ciberseguridad con salvaguardas utilizaron Opus 4.8; las tareas de biología y desarrollo de modelos de frontera utilizaron Opus 5. AutomationBench no utilizó ninguna alternativa de respaldo.

Anthropic informa de menos acciones irreversibles o fuera de límites en su auditoría de comportamiento. Su guía para redactar instrucciones también informa de una mayor resistencia a la inyección indirecta de instrucciones que la de los modelos Opus anteriores. Ambos resultados proceden de pruebas de la empresa y no constituyen una certificación general de seguridad.

Los clientes de API deben solicitar una migración explícita

Los clientes de API deben solicitar claude-opus-5-5; las llamadas existentes a Opus 5 no cambian de modelo de forma silenciosa. La referencia de migración enumera varios cambios en las solicitudes que, de otro modo, pueden producir errores o alterar el flujo de salida de una aplicación.

Punto de migración

Comportamiento de Opus 5.5

Selección del modelo

Usa el identificador claude-opus-5-5 explícitamente.

Razonamiento

El razonamiento adaptativo siempre está activado. Desactivarlo y especificar presupuestos manuales de tokens devuelve un error HTTP 400.

Nivel de esfuerzo

Usa low, medium, high, xhigh o max; el valor predeterminado es medium.

Herramientas forzadas

tool_choice admite los valores any y tool, que devuelven un error HTTP 400; auto y none siguen admitidos.

Uso del ordenador

El tipo de herramienta anterior computer_20251124 se rechaza en la API de Claude y Google Cloud; Amazon Bedrock sigue admitiéndolo.

Texto de progreso

El texto entre llamadas a herramientas llega en bloques de razonamiento, así que un cliente que, como es habitual, no muestre ese contenido puede parecer inactivo entre llamadas.

El razonamiento conservado añade otra limitación para los clientes con tareas largas. Los bloques de razonamiento están vinculados a un modelo y a un prefijo de conversación. En las cuentas de API y plataformas en la nube creadas a partir del 31 de agosto de 2026, cambiar instrucciones, herramientas o mensajes anteriores antes de volver a reproducir un bloque provoca por defecto un error 400. La documentación de Anthropic sobre el razonamiento conservado explica el método de solo añadir contenido y la opción controlada de descartar un bloque incompatible.

El enrutamiento de seguridad puede cambiar el modelo que responde

La guía para redactar instrucciones describe salvaguardas para biología al nivel de Fable 5.1 y clasificadores de ciberseguridad y extracción de razonamiento. Sigue estando permitido detectar vulnerabilidades en código fuente, y las organizaciones pueden solicitar verificación para ciencias biológicas. Se ha anunciado una ampliación de la verificación en ciberseguridad para las próximas semanas.

Un rechazo puede llegar con HTTP 200 y stop_reason: "refusal". La documentación sobre alternativas de respaldo describe el respaldo gestionado por el servidor, el middleware de los SDK y los reintentos gestionados por el cliente. El respaldo solo ocurre cuando se configura una de esas vías admitidas; no se garantiza automáticamente en todas las solicitudes a Opus 5.5. Aun así, se pueden rechazar categorías para las que no se recomienda una alternativa de respaldo.

Por eso, el modelo que finalmente atiende la solicitud forma parte del resultado. Una aplicación que migre a Opus 5.5 debería registrar por separado los rechazos y las respuestas proporcionadas mediante respaldo, especialmente si trabaja en ámbitos con salvaguardas. Las tarifas más bajas y las afirmaciones sobre capacidades más amplias corresponden a Opus 5.5; una solicitud redirigida sigue el comportamiento y los límites del modelo que realmente respondió.