НовостиАкцииClaude Sonnet 5.5 от Anthropic почти догоняет Opus по производительности, снижая стоимость задач до 30%

Claude Sonnet 5.5 от Anthropic почти догоняет Opus по производительности, снижая стоимость задач до 30%

Автор: CryptoBriefing·

Ключевые выводы

  • •Anthropic выпустила Claude Sonnet 5.5 — вторую модель в семействе Claude 5.5, ориентированную на программирование, повседневную продуктивность и работу с документами в более дешёвом ценовом уровне.
  • •Модель генерирует результат более чем на 30% быстрее, чем Sonnet 5, и снижает стоимость задачи до 30% благодаря эффективности токенов; цены за токен остаются на уровне $2 за миллион входных и $10 за миллион выходных токенов.
  • •Sonnet 5.5 обошёл Opus 5.5 на Terminal-Bench 4.0 со счётом 70,6% против 66,4% и почти сравнялся на GDPval-AA, набрав 1 844 против 1 846 у Opus.
  • •В оценках программирования Sonnet 5.5 улучшил результат примерно на 10 очков по сравнению с Sonnet 5 на FrontierCode при высоком уровне усилий, при этом стоимость задачи составила около одной пятнадцатой.
  • •Это первая модель Sonnet со средствами кибербезопасности, сопоставимыми со старшими уровнями Anthropic; из-за этого более рискованные запросы в области кибербезопасности могут перенаправляться на Sonnet 5.
Claude Sonnet 5.5 от Anthropic почти догоняет Opus по производительности, снижая стоимость задач до 30%

Anthropic выпустила Claude Sonnet 5.5 — вторую модель в семействе Claude 5.5, позиционируя её как более быстрый и экономичный вариант для программирования, повседневной работы и создания документов.

Модель генерирует результат более чем на 30% быстрее своей предшественницы Sonnet 5 и, по данным компании, стоит до 30% дешевле за задачу в её тестах, согласно анонсу Anthropic. Экономия в основном обусловлена эффективностью: Sonnet 5.5 требует меньше токенов для выполнения той же работы. Цена за токен при этом не изменилась — $2 за миллион входных токенов и $10 за миллион выходных. Это различие важно для команд, использующих модель в больших объёмах: поскольку базовые цены остались прежними, экономия проявляется на уровне задач, где расходы растут вместе с использованием.

Anthropic представляет Sonnet 5.5 как менее дорогое дополнение к Claude Opus 5.5. Opus по-прежнему ориентирован на сложную открытую работу, требующую устойчивого суждения, тогда как Sonnet предназначен для более чётко определённых задач, таких как исправление ошибок и создание документов, презентаций и таблиц.

Однако на некоторых оценках разрыв между двумя моделями заметно сократился. Sonnet 5.5 превзошёл Opus 5.5 на Terminal-Bench 4.0, показав 70,6% против 66,4%. На GDPval-AA — бенчмарке, измеряющем работу со знаниями в реальных условиях, — результаты почти сравнялись: Sonnet 5.5 набрал 1 844 против 1 846 у Opus 5.5. Anthropic сообщила, что при определённых настройках усилий Sonnet 5.5 работает наравне с Opus 5.5, хотя компания по-прежнему считает Opus более сильной моделью для сложных задач, требующих устойчивого суждения. Для покупателей, выбирающих между двумя уровнями, эти результаты служат ориентиром того, какая измеримая производительность сохраняется при более низкой стоимости задачи у Sonnet.

Программирование — одна из крупнейших областей улучшений. По данным Anthropic, Sonnet 5.5 улучшил результат примерно на 10 очков по сравнению с Sonnet 5 на FrontierCode при высоком уровне усилий, при этом стоимость одной задачи составила около одной пятнадцатой. Лучший результат модели на CursorBench также отстал от Opus 5.5 примерно на два очка.

Значительные успехи достигнуты и в более широкой работе со знаниями. Anthropic сообщила, что Sonnet 5.5 приблизился к Opus 5.5 в использовании компьютера и распознавании диаграмм, превзойдя Sonnet 5 во внутренних и внешних оценках компании.

Sonnet 5.5 также стал первой моделью Sonnet, выпущенной со средствами защиты в области кибербезопасности, сопоставимыми с таковыми у старших моделей Anthropic, после существенного улучшения её возможностей в этой сфере по сравнению с предыдущим поколением. В результате более рисанные запросы, связанные с кибербезопасностью, могут перенаправляться на Sonnet 5, тогда как обычные задачи разработки остаются доступны — компромисс между более строгой защитой и доступностью задач, который командам, использующим модель в смежных с безопасностью областях, придётся учитывать.

Модель доступна на платформах Anthropic, а также через Amazon Web Services, Google Cloud и Microsoft Azure. Разработчики могут получить к ней доступ через Claude Platform по идентификатору claude-sonnet-5-5.

Anthropic добавила, что Claude Haiku 5.5 — модель, ориентированная на приложения с большим объёмом запросов и чувствительные к стоимости, — пополнит семейство Claude 5.5 в ближайшие недели. После его выхода семейство будет охватывать весь диапазон уровней Anthropic — от устойчивой сложной работы до массового развёртывания.