Claude Opus 5.5 de Anthropic iguala al Fable insignia 5.1 a un 60% del precio
Puntos clave
- •Los precios por token de Opus 5.5 de $4 por entrada y $20 por salida subcotan a su predecesor en un 20% y al insignia Fable 5.1 en un 60%, con los costos de lectura de caché cayendo un 60% hasta $0.20 por millón de tokens.
- •Los benchmarks de Anthropic ubican a Opus 5.5 por delante de Fable 5.1 y Opus 5 en pruebas de programación y trabajo del conocimiento, incluida una tasa de finalización del 66.4% en Terminal-Bench 4.0 y un puntaje Elo de 1846 en GDPval-AA v2.1.
- •GPT-6 Astra aún supera a Opus 5.5 en AutomationBench, 41.4% frente a 40.0%, y en Terminal-Bench-Science 0.1, 64.6% frente a 58.7%.
- •El modelo se lanza con las mismas salvaguardas de ciberseguridad y biología que Fable 5.1, y la mayoría de las tareas de ciberseguridad siguen redirigiéndose automáticamente al antiguo Opus 4.8.
- •Opus 5.5 es el tercer modelo de clase insignia que Anthropic lanza desde el verano, tras la publicación por parte del CEO Dario Amodei de un ensayo en el que instaba a la industria a frenar el ritmo de las mejoras en capacidades de la IA.

Anthropic lanzó el martes Claude Opus 5.5, el primer modelo de lo que la empresa denomina su familia Claude 5.5. El modelo tiene un precio de $4 y $20 por millón de tokens de entrada y salida—un 40% más barato que Opus 5 en su configuración predeterminada—y Anthropic afirma que iguala a Claude Fable 5.1, su insignia más costoso, en la mayoría de las tareas.
Según las propias cifras de Anthropic, Opus 5.5 supera tanto a Fable 5.1 como a su predecesor, Opus 5, en pruebas de programación y trabajo del conocimiento, aunque GPT-6 Astra todavía lo supera en AutomationBench y Terminal-Bench-Science 0.1. El nuevo modelo se lanza con las mismas salvaguardas de ciberseguridad y biología que Fable 5.1.
El lanzamiento subcota tanto al modelo que reemplaza como al insignia al que persigue: Opus 5.5 cuesta un 20% menos de ejecutar que Opus 5 y es un 60% más barato que Fable 5.1, la oferta más avanzada de la empresa.
El modelo es el más avanzado de Anthropic tanto por versión (5.5 frente al 5.1 de Fable) como por nivel de familia: Opus es el modelo más grande disponible públicamente, seguido de Sonnet, siendo Haiku el más pequeño. Anthropic reconoce que la brecha real entre Fable y Opus es menor de lo que sugieren los puntajes de los benchmarks, pero la disponibilidad pública de Opus en planes pagos y su menor costo por token lo convierten en la opción obvia para la mayoría de los usuarios de Claude.
Las dos líneas de producto se han alternado el liderazgo este año. Opus 5 se lanzó en julio, con precios más bajos y puntajes superiores a los de Fable 5 en la mayoría de los benchmarks. Fable 5.1 llegó a principios de septiembre e invirtió la situación, superando a Opus 5 en cada benchmark que Anthropic publicó. Opus 5.5 cierra la brecha de nuevo—esta vez en precio en lugar de puntajes.
Lovable, una plataforma para desarrolladores que evaluó a Opus 5 en sus propias pruebas de programación en julio, dijo en un comunicado compartido por Anthropic que el modelo anterior era "más estable, con mucha variación entre ejecuciones" que lo que venía antes—el mismo argumento de eficiencia que Anthropic plantea ahora.
Opus 5.5 también es el primer modelo que Anthropic lanza desde que el CEO Dario Amodei publicó un ensayo pidiendo a la industria que frene el ritmo, argumentando que los avances en capacidades de la IA superan las pruebas de seguridad destinadas a mantenerlos bajo control. "Debemos frenar el ritmo al que mejoramos las capacidades de los modelos de IA", escribió Amodei a principios de este mes. Anthropic ha lanzado ahora tres modelos de clase insignia desde el verano—Opus 5 en julio, Fable 5.1 a principios de septiembre y Opus 5.5 el martes—justo el ritmo que el ensayo argumenta que debería frenarse.
Anthropic mide gran parte de este progreso mediante la programación agéntica: trabajo realizado por un agente de IA, un modelo que ejecuta acciones de múltiples pasos por sí mismo en lugar de simplemente responder a un solo mensaje.
En Terminal-Bench 4.0, que evalúa si un agente puede completar tareas profesionales complejas dentro de una interfaz de línea de comandos y puntúa los resultados como porcentaje de tareas completadas, Opus 5.5 alcanzó el 66.4%, por delante del 55.8% de Fable 5.1 y del 57.9% de GPT-6 Astra. FrontierCode, que verifica si los cambios de código de un agente realmente se fusionarían en un flujo de ingeniería real usando el mismo sistema de puntaje de aprobación, ubicó a Opus 5.5 en 54.4% frente al 50.3% de Fable 5.1.
En GDPval-AA v2.1, que califica trabajo profesional del mundo real en 44 ocupaciones usando Elo—el sistema de clasificación estilo ajedrez que mide habilidad relativa en lugar de un porcentaje plano—Opus 5.5 obtuvo 1846, frente al 1735 de Fable 5.1 y el 1708 de Opus 5.
Opus 5.5 no lidera en todas partes. En AutomationBench, un benchmark creado por Zapier que evalúa si un agente puede llevar un flujo de trabajo comercial completo de principio a fin sin ayuda humana, el 41.4% de GPT-6 Astra supera por poco el 40.0% de Opus 5.5. En Terminal-Bench-Science 0.1, que evalúa investigación científica agéntica realizada en un entorno de línea de comandos con el mismo método de puntaje de aprobación, el 64.6% de Astra supera por un margen mayor el 58.7% de Opus 5.5.
El mayor punto de venta es el costo. Los tokens de entrada—los fragmentos de texto que un modelo lee y escribe, con precio por millón—ahora cuestan $4 para Opus 5.5 frente a $5 para Opus 5, y los tokens de salida bajan de $25 a $20. Las lecturas de caché, que reutilizan contexto que un modelo ya procesó en lugar de reprocesarlo desde cero y representan la mayor parte del costo de las largas sesiones de programación agéntica, caen un 60% hasta $0.20 por millón de tokens. La estructura hace que el descuento se multiplique donde más importa: las sesiones extendidas de programación agéntica se facturan principalmente por lecturas de caché, por lo que el recorte más fuerte recae en el rubro más grande.
Debido a que Opus 5.5 iguala a los modelos de clase Mythos de Anthropic—el nivel más restringido de la empresa, reservado para investigadores de ciberseguridad y biología verificados—en esas dos capacidades, se lanza con las mismas salvaguardas que Fable 5.1. La mayoría de las tareas de ciberseguridad se redirigen automáticamente al antiguo Opus 4.8, una práctica de la que muchos desarrolladores y usuarios se han quejado anteriormente. Queda por ver si la llegada de Op 5.5 cambia ese comportamiento de redirección.
Opus 5.5 ya está disponible en las plataformas de Anthropic, incluidas Amazon Web Services, Google Cloud y Microsoft Azure. Sonnet 5.5 y Haiku 5.5 llegarán en las próximas semanas, según Anthropic, con las mismas rebajas de precio en el resto de la línea.