NoticiasAccionesAnthropic lanza Claude Sonnet 5.5, que supera a Opus 5.5 en programación por la mitad del precio

Anthropic lanza Claude Sonnet 5.5, que supera a Opus 5.5 en programación por la mitad del precio

Autor: Decrypt·

Puntos clave

  • •Claude Sonnet 5.5 debutó con precios sin cambios de $2 por millón de tokens de entrada y $10 por millón de tokens de salida, la mitad de las tarifas que Anthropic cobra por Opus 5.5.
  • •El nuevo modelo superó a Opus 5.5 en las pruebas de programación de Terminal-Bench 4.0, con 70.6% frente a 66.4% en los resultados de Anthropic y 63.6% frente a 59.6% en la ejecución independiente de Artificial Analysis.
  • •Con el esfuerzo máximo, Sonnet 5.5 generó alrededor de 193,000 tokens por tarea, la mayor cantidad que Artificial Analysis ha medido, con un costo de $7.60 por tarea, aproximadamente 50% más que Sonnet 5.
  • •Anthropic afirma que el modelo corre más de 30% más rápido que Sonnet 5 y usa casi un tercio menos de tokens por tarea, lo que lo hace más barato de operar a pesar de los precios de lista idénticos.
  • •Claude Haiku 5.5, diseñado para aplicaciones de alto volumen y sensibles al costo, se espera en las próximas semanas para completar la línea de la generación 5.5 de Anthropic.
Anthropic lanza Claude Sonnet 5.5, que supera a Opus 5.5 en programación por la mitad del precio

Anthropic lanzó el lunes Claude Sonnet 5.5, la versión más reciente de su modelo de IA de gama media y una actualización de Sonnet 5, que debutó en junio. El precio se mantiene sin cambios: $2 por millón de tokens de entrada y $10 por millón de tokens de salida, la mitad de lo que la empresa cobra por Opus 5.5.

A pesar del precio más bajo, el modelo ya supera a su hermano mayor en programación. En Terminal-Bench 4.0, Sonnet 5.5 obtuvo 70.6% frente a 66.4% de Opus 5.5, según Anthropic. Artificial Analysis, una firma de pruebas independiente, ejecutó su propia versión del benchmark y también colocó a Sonnet 5.5 por delante, con 63.6% frente a 59.6%. No obstante, la firma lo ubica en el segundo lugar general detrás de Opus 5.5 en su clasificación y señala que utilizó más tokens por tarea que cualquier modelo que haya probado.

Anthropic afirma que el nuevo modelo corre más de 30% más rápido que su predecesor. "Sonnet 5.5 es más fuerte en tareas cotidianas bien definidas, corregir errores y crear documentos, diapositivas y hojas de cálculo pulidos. También tiene un ojo agudo para el diseño", escribió la empresa.

Los tokens son los fragmentos de texto que un modelo de IA lee y escribe, ligeramente más cortos que una palabra, y las empresas de IA cobran por millón. Si bien el precio de lista coincide con el de Sonnet 5, el nuevo modelo usa casi un tercio menos de tokens por tarea, lo que significa que termina siendo más barato de operar que su predecesor a pesar de las tarifas idénticas.

Donde el modelo realmente brilla es en la programación. Terminal-Bench 4.0 mide si un agente de IA puede completar tareas profesionales complejas escribiendo comandos por sí solo, con puntajes basados en la proporción de tareas completadas. Sonnet 5.5 alcanzó 70.6%. Opus 5.5 obtuvo 66.4%, y Sonnet 5 logró apenas 10.3%. En términos sencillos, el modelo más barato completó más trabajos.

La ejecución independiente de Artificial Analysis coincide: 63.6% para Sonnet 5.5, 59.6% para Opus 5.5 y 59.1% para GPT-6 Astra de OpenAI. La firma destacó los avances del modelo en una publicación en X:

Claude Sonnet 5.5 (max) makes large strides on Terminal-Bench, sitting among the top models for both Terminal-Bench 4.0 and Terminal-Bench-Science. In Terminal-Bench 4.0 it scores 64%, a 50 point increase over Claude Sonnet 5 (max), and slightly above 60% for Opus 5.5 and GPT-6… pic.twitter.com/7CPrhgmfxe

— Artificial Analysis (@ArtificialAnlys) September 28, 2026

Los puntajes también dependen de configuración de esfuerzo, un dial que hace que el modelo piense más tiempo para obtener una mejor respuesta, y una factura más grande. Anthropic dice que Sonnet 5.5 con esfuerzo High iguala a GPT6 Sol en FrontierCode por aproximadamente una quinta parte del costo por tarea.

En GDPval-AA, que califica el trabajo profesional del mundo real en 44 ocupaciones usando Elo, el sistema de calificación estilo ajedrez que clasifica la habilidad relativa, Sonnet 5.5 obtuvo 1844 frente a 1846 de Opus 5.5, prácticamente un empate. GPT-6 Sol obtuvo 1487.

Los competidores igualan el precio. OpenAI recortó GPT-6 Sol a $2 y $10 la semana pasada, mientras que GPT-5.6 Terra, su modelo de gama media, se lista a $2 y $12. Sonnet 5.5 y GPT-6 Sol ahora llevan precios de lista idénticos, aunque, como muestran las configuraciones de esfuerzo anteriores, tarifas de lista iguales no garantizan costos por tarea equivalentes. Anthropic no publicó cifras de benchmarks para Terra.

La contrapartida

La contrapartida es la verbosidad. Sonnet 5.5 habla mucho: con el esfuerzo máximo escribió alrededor de 193,000 tokens por tarea de prueba, la mayor cantidad que Artificial Analysis ha medido y aproximadamente 60% más que Opus 5.5. Eso significó $7.60 por tarea, alrededor de 50% más que Sonnet 5, un resultado que contradice la afirmación de Anthropic de ahorros de hasta 30%.

Las afirmaciones de ahorro de Anthropic se basan en configuraciones más bajas. Con esfuerzo Medium, el valor predeterminado en sus aplicaciones, la empresa dice que Sonnet 5.5 supera el mejor puntaje de programación de Sonnet 5 por menos de una décima parte del costo. Artificial Analysis dice que el esfuerzo High ofrece el mejor valor. Para los usuarios cotidianos, eso significa programación casi de nivel insignia por una fracción del precio, siempre que el dial se mantenga bajo.

Persisten advertencias. La tabla de benchmarks de Anthropic es autoinformada, y Artificial Analysis probó una versión de prelanzamiento con un error que Anthropic espera que cambiara poco o subestimara ligeramente sus puntajes, razón por la cual los resultados independientes sobre la versión final valen la pena observar. La empresa también dice que Opus 5.5 sigue siendo claramente más fuerte en trabajo complejo que requiere juicio sostenido.

Claude Haiku 5.5, diseñado para aplicaciones de alto volumen y sensibles al costo, llegará en las próximas semanas y completaría la línea de la generación 5.5 de Anthropic junto a Opus 5.5 y Sonnet 5.5.