НовостиАкцииAnthropic выпустила Claude Sonnet 5.5: кодирует лучше Opus 5.5 вдвое дешевле

Anthropic выпустила Claude Sonnet 5.5: кодирует лучше Opus 5.5 вдвое дешевле

Автор: Decrypt·

Ключевые выводы

  • •Claude Sonnet 5.5 дебютирует с прежними ценами — $2 за миллион входных токенов и $10 за миллион выходных, вдвое дешевле тарифов Anthropic на Opus 5.5.
  • •Новая модель обошла Opus 5.5 в кодинговых тестах Terminal-Bench 4.0: 70,6% против 66,4% по данным Anthropic и 63,6% против 59,6% в независимом запуске Artificial Analysis.
  • •На максимальном уровне усилий Sonnet 5.5 генерировала около 193 000 токенов на задачу — больше всех, что измеряла Artificial Analysis, при стоимости $7,60 за задачу — примерно на 50% дороже Sonnet 5.
  • •Anthropic заявляет, что модель работает более чем на 30% быстрее Sonnet 5 и потребляет почти на треть меньше токенов на задачу, что делает её дешевле в эксплуатации при одинаковых прайс-тарифах.
  • •Claude Haiku 5.5, рассчитанная на высоконагруженные приложения с чувствительной к затратам экономикой, ожидается в ближайшие недели и завершит линейку поколения 5.5.
Anthropic выпустила Claude Sonnet 5.5: кодирует лучше Opus 5.5 вдвое дешевле

Anthropic в понедельник выпустила Claude Sonnet 5.5 — новейшую версию своей ИИ-модели среднего уровня и обновление Sonnet 5, вышедшей в июне. Цены не изменились: $2 за миллион входных токенов и $10 за миллион выходных — вдвое меньше того, что компания берёт за Opus 5.5.

Несмотря на более низкую цену, модель уже обходит старшую «сестру» в программировании. По данным Anthropic, на Terminal-Bench 4.0 Sonnet 5.5 набрала 70,6% против 66,4% у Opus 5.5. Независимая компания Artificial Analysis провела собственную версию бенчмарка и также поставила Sonnet 5.5 впереди — 63,6% против 59,6%. Тем не менее в своём рейтинге фирма ставит её на второе место позади Opus 5.5 и отмечает, что на задачу она потратила больше токенов, чем любая из протестированных моделей.

Anthropic заявляет, что новая модель работает более чем на 30% быстрее предшественницы. «Sonnet 5.5 сильнее всего в чётко очерченных повседневных задачах, исправлении багов и создании аккуратных документов, презентаций и таблиц. У неё также отличный вкус к дизайну», — написала компания.

Токены — это фрагменты текста, которые ИИ-модель читает и пишет, чуть короче слова, а ИИ-компании тарифицируют их за миллион. Хотя прайс совпадает с Sonnet 5, новая модель использует почти на треть меньше токенов на задачу, что делает её в итоге дешевле в эксплуатации, несмотря на одинаковые тарифы.

Больше всего модель преуспевает в программировании. Terminal-Bench 4.0 проверяет, способен ли ИИ-агент самостоятельно, путём ввода команд, выполнить сложные профессиональные задачи; результат оценивается как доля выполненных задач. Sonnet 5.5 набрала 70,6%. У Opus 5.5 — 66,4%, а у Sonnet 5 — лишь 10,3%. Проще говоря, более дешёвая модель выполнила больше заданий.

Независимый запуск Artificial Analysis подтверждает: 63,6% у Sonnet 5.5, 59,6% у Opus 5.5 и 59,1% у GPT-6 Astra от OpenAI. Компания отметила достижения модели в публикации на X:

Claude Sonnet 5.5 (max) makes large strides on Terminal-Bench, sitting among the top models for both Terminal-Bench 4.0 and Terminal-Bench-Science. In Terminal-Bench 4.0 it scores 64%, a 50 point increase over Claude Sonnet 5 (max), and slightly above 60% for Opus 5.5 and GPT-6… .twitter.com/7CPrhgmfxe

— Artificial Analysis (@ArtificialAnlys) September 28, 2026

Результаты также зависят от настройки усилий — регулятора, который заставляет модель дольше размышлять ради лучшего ответа и более крупного счёта. Anthropic сообщает, что Sonnet 5.5 на уровне High в FrontierCode соответствует GPT6 Sol при примерно пятой части стоимости за задачу.

На GDPval-AA, который оценивает реальную профессиональную работу по 44 профессиям с помощью Elo — шахматной системы рейтингов относительного мастерства, — Sonnet 5.5 набрала 1844 против 1846 у Opus 5.5, то есть фактически ничью. GPT-6 Sol набрала 1487.

Конкуренты выравнивают цены. OpenAI на прошлой неделе снизила тарифы GPT-6 Sol до $2 и $10, а её модель среднего уровня GPT-5.6 Terra стоит $2 и $12. Sonnet 5.5 и GPT-6 Sol теперь имеют одинаковые прайс-тарифы — хотя, как показывают настройки усилий, совпадение прайсов не гарантирует одинаковой стоимости за задачу. Benchmark-показатели для Terra Anthropic не опубликовала.

В чём подвох

Обратная сторона — многословность. Sonnet 5.5 — большая разговорщица: на максимальном уровне усилий она написала около 193 000 токенов за тестовую задачу — больше всех, что измеряла Artificial Analysis, и примерно на 60% больше, чем Opus 5.5. Это обошлось в $7,60 за задачу — примерно на 50% дороже Sonnet 5, что противоречит заявлению Anthropic об экономии до 30%.

Заявления Anthropic об экономии основаны на более низких настройках. На уровне Medium — по умолчанию в её приложениях — компания говорит, что Sonnet 5.5 превосходит лучший кодинговый результат Sonnet 5 менее чем за десятую часть стоимости. По оценке Artificial Analysis, наилучшее соотношение цены и качества даёт уровень High. Для обычных пользователей это означает кодирование почти флагманского уровня за малую долю цены — пока регулятор остаётся низким.

Оговорки остаются. Таблица бенчмарков Anthropic — самоотчётная, а Artificial Analysis тестировала пре-релизную сборку с багом, который, по ожиданиям Anthropic, мало что изменил или слегка занизил результаты — одна из причин следить за независимыми результатами на релизной сборке. Компания также заявляет, что Opus 5.5 остаётся заметно сильнее в сложной работе, требующей устойчивого суждения.

Claude Haiku 5.5, созданная для высоконагруженных приложений с чувствительной к затратам экономикой, ожидается в ближайшие недели и дополнит линейку поколения 5.5 вместе с Opus 5.5 и Sonnet 5.5.