Claude Sonnet 5.5 de Anthropic se acerca al rendimiento de Opus mientras reduce los costos por tarea hasta un 30%
Puntos clave
- •Anthropic lanzó Claude Sonnet 5.5 como el segundo modelo de su familia Claude 5.5, orientado a la programación, la productividad diaria y el trabajo con documentos en un nivel de menor costo.
- •El modelo produce resultados más de un 30% más rápido que Sonnet 5 y reduce los costos por tarea hasta un 30% mediante eficiencia en tokens, mientras el precio por token se mantiene en 2 dólares por millón de tokens de entrada y 10 dólares por millón de tokens de salida.
- •Sonnet 5.5 superó a Opus 5.5 en Terminal-Bench 4.0, con 70.6% frente a 66.4%, y quedó a dos puntos en GDPval-AA, con 1,844 frente a 1,846 de Opus.
- •En las evaluaciones de programación, Sonnet 5.5 mejoró aproximadamente 10 puntos frente a Sonnet 5 en FrontierCode con esfuerzo High, mientras cuesta alrededor de una quincena parte por tarea.
- •Es el primer modelo Sonnet que incluye salvaguardas de ciberseguridad comparables a las de los niveles de gama alta de Anthropic, un cambio que podría redirigir solicitudes de ciberseguridad de mayor riesgo a Sonnet 5.

Anthropic ha lanzado Claude Sonnet 5.5, el segundo modelo de su familia Claude 5.5, posicionándolo como una opción más rápida y económica para programación, trabajo diario y creación de documentos.
El modelo genera resultados más de un 30% más rápido que su predecesor, Sonnet 5, y cuesta hasta un 30% menos por tarea en las pruebas de la compañía, según el anuncio de Anthropic. El ahorro se debe en gran parte a la eficiencia: Sonnet 5.5 requiere menos tokens para completar el mismo trabajo. El precio por token se mantiene sin cambios: 2 dólares por millón de tokens de entrada y 10 dólares por millón de tokens de salida. Esta distinción importa para los equipos que ejecutan el modelo a gran escala: como los precios de lista no cambian, el ahorro se produce a nivel de tarea, donde los costos se acumulan con el uso.
Anthropic presenta Sonnet 5.5 como un complemento de menor costo para Claude Opus 5.5. Opus sigue orientado a trabajos complejos y abiertos que exigen un juicio sostenido, mientras que Sonnet está diseñado para tareas más claramente definidas, como la corrección de errores y la creación de documentos, diapositivas y hojas de cálculo.
Sin embargo, en algunas evaluaciones la brecha entre los dos modelos se ha reducido considerablemente. Sonnet 5.5 superó a Opus 5.5 en Terminal-Bench 4.0, con un 70.6% frente a un 66.4%. En GDPval-AA, un benchmark que mide el trabajo de conocimiento en el mundo real, ambos estuvieron casi empatados, con Sonnet 5.5 obteniendo 1,844 frente a 1,846 de Opus 5.5. Anthropic señaló que, en ciertos niveles de esfuerzo, Sonnet 5.5 rinde al nivel de Opus 5.5, aunque la compañía sigue considerando a Opus como el modelo más fuerte para tareas complejas que requieren un juicio sostenido. Para quienes evalúan ambos niveles, esos resultados ofrecen un punto de referencia sobre cuánta capacidad medida se conserva con el menor costo por tarea de Sonnet.
La programación es una de las áreas de mayor mejora. Anthropic informó que Sonnet 5.5 ganó aproximadamente 10 puntos frente a Sonnet 5 en FrontierCode con esfuerzo High, mientras cuesta alrededor de una quincena parte por tarea. La mejor puntuación del modelo en CursorBench también quedó a unos dos puntos de Opus 5.5.
El trabajo de conocimiento más amplio también registró ganancias significativas. Anthropic indicó que Sonnet 5.5 se acercó a Opus 5.5 en uso de computadora y reconocimiento de gráficos, y superó a Sonnet 5 en sus evaluaciones internas y externas.
Sonnet 5.5 es también el primer modelo Sonnet que se lanza con salvaguardas de ciberseguridad comparables a las de los modelos de gama alta de Anthropic, tras una mejora sustancial de sus capacidades cibernéticas respecto de la generación anterior. Como resultado, las solicitudes de ciberseguridad de mayor riesgo pueden derivarse a Sonnet 5, mientras que tareas rutinarias de desarrollo siguen disponibles: un equilibrio entre salvaguardas más estrictas y disponibilidad de tareas que los equipos que usan el modelo para trabajos relacionados con la seguridad deberán tener en cuenta.
El modelo está disponible en las plataformas de Anthropic, así como en Amazon Web Services, Google Cloud y Microsoft Azure. Los desarrolladores pueden acceder a él a través de la Claude Platform con el identificador claude-sonnet-5-5.
Anthropic añadió que Claude Haiku 5.5, un modelo orientado a aplicaciones de alto volumen y sensibles al costo, se unirá a la familia Claude 5.5 en las próximas semanas. Cuando salga, la familia cubrirá todo el rango de niveles de Anthropic, desde el trabajo complejo sostenido hasta el despliegue de alto volumen.