Anthropic выпускает Claude Sonnet 5.5 на фоне смещения фокуса оценки ИИ к стоимости за задачу
Ключевые выводы
- •Anthropic заявляет, что Claude Sonnet 5.5 работает более чем на 30% быстрее предшественницы и выполняет большинство задач на срок до 30% дешевле за счет меньшего расхода токенов, при этом цены за токены не изменились.
- •Sonnet 5.5 сохраняет прежнее ценообразование: $2 за миллион входных токенов, $10 за миллион выходных токенов и $0,20 за миллион токенов чтения из кэша.
- •Модель набирает 70,6% на Terminal-Bench 4.0 против 10,3% у Sonnet 5, однако независимые данные показывают, что конкуренты вроде GPT-6 Sol и MiMo-V2.6-Pro от Xiaomi достигают сопоставимого уровня интеллекта при значительно меньших затратах на задачу.
- •Цитируемые в статье исследования показывают, что стоимость достижения заданного уровня производительности ИИ с 2023 года падала примерно на 47% в квартал, при этом Gartner прогнозирует рост общих расходов на инференс в пересчете на агентский рабочий процесс более чем в пять раз до 2028 года.
- •Anthropic, получающая около 80% выручки от корпоративных клиентов, как сообщается, готовится к IPO; выход Haiku 5.5 ожидается в ближайшие недели.

Anthropic выпустила Claude Sonnet 5.5 28 сентября — вторую модель в серии Claude 5.5, анонсировав дебют в официальном посте в X. Как сообщает Reuters, релиз состоялся на фоне подготовки компании к первичному публичному размещению акций. Он также подчеркивает изменение критериев оценки технологий ИИ: производительность в бенчмарках остается важным фактором, однако компании все чаще учитывают, насколько дорого обходится получение результатов с конкретной моделью.
По данным Anthropic, Sonnet 5.5 работает более чем на 30% быстрее Sonnet 5 и может выполнять большинство задач на срок до 30% дешевле, хотя цены за токены остались прежними. Согласно странице запуска модели, снижение затрат достигается за счет меньшего расхода токенов при выполнении той же работы.
Та же цена, меньше токенов
Sonnet 5.5 стоит $2 за миллион входных токенов, $10 за выходные токены и $0,20 за токены чтения из кэша — льготный тариф за повторное использование уже обработанного моделью контекста. Opus 5.5, ориентированная на сложные задачи рассуждения и вынесения суждений, стоит $4 и $20 за входные и выходные токены соответственно. Sonnet предназначена для повседневных рабочих нагрузок: программирования, создания документов и работы с таблицами.
Такое ценообразование выводит эффективность на первый план обсуждения. Для многих задач компаниям не нужна самая производительная модель на рынке; недорогая модель, стабильно выполняющая работу, может оказаться важнее, чем преимущество в несколько баллов в бенчмарке. Этот аспект особенно значим для Anthropic, которая, по данным Reuters, получает около 80% выручки от корпоративных клиентов.
Бенчмарки перестают быть всей историей
Anthropic заявляет, что Sonnet 5.5 набирает 70,6% на Terminal-Bench 4.0 — агентском бенчмарке, проверяющем модели на реальных задачах в терминале, — против 10,3% у Sonnet 5. Однако рейтинг Artificial Analysis от независимого оценщика Artificial Analysis показывает, почему результаты бенчмарков — лишь часть картины. При максимальном уровне усилий Sonnet 5.5 достигает 56 баллов по шкале интеллекта при расчетной стоимости $7,60 за задачу. GPT-6 Sol набирает 48 баллов при $1,06 за задачу, а MiMo-V2.6-Pro от Xiaomi — 46 баллов при символических $0,13. Иными словами, лидерство по интеллекту не обязательно означает лидерство по экономической эффективности — а при больших объемах работы такие различия в стоимости задачи быстро накапливаются.
Эти различия в затратах подталкивают компании к мультимодельным стратегиям: сложные задачи поручаются премиальным системам, а рутинная работа направляется более дешевым альтернативам. Такой подход позволяет организациям платить за топовую производительность только там, где она действительно необходима.
Цена мышления продолжает падать
Этот сдвиг укладывается в гораздо более масштабную тенденцию. Согласно отчету Epoch AI, опубликованному 22 сентября, стоимость достижения заданного уровня производительности ИИ с 2023 года снижалась примерно на 47% в квартал — это примерно 13-кратное годовое сокращение. В отдельном отчете Cryptopolitan от 29 сентября говорится, что корпоративные покупатели все чаще отдают предпочтение самой доступной модели, способной выполнить требуемую работу, а низкие цены также упрощают для бизнеса обоснование одновременного использования нескольких моделей.
Дешевле токены — больше счета
Однако снижение удельных затрат не гарантирует снижения общих расходов на ИИ. В отчете Gartner, опубликованном 17 августа и озаглавленном «Gartner Predicts AI Inference Costs Per Agentic Workflow Will Increase More Than Fivefold Through 2028», описывается «парадокс инференса»: падение цен на токены стимулирует более сложные рабочие процессы, что увеличивает общий расход токенов. Удельные цены и общие расходы — разные рычаги: первая определяет стоимость каждого токена, а вторые зависят от того, сколько токенов потребляет рабочий процесс.
«Руководители продуктов не могут полагаться на более эффективную экономику токенов, чтобы оправдать затраты на ИИ», — заявил Уилл Соммер, старший директор-аналитик Gartner, в отчете от 17 августа 2026 года.
Кому на самом деле достается более дешевый ИИ
Согласно Global AI Diffusion Report от Microsoft, недорогие модели с открытыми весами способны значительно улучшить доступ к ИИ, особенно в странах Глоб Юга. Тем не менее само по себе снижение стоимости моделей не определит уровень их внедрения — решающими факторами остаются инфраструктура, связанность и навыки.
Для корпоративных покупателей Sonnet 5.5 указывает направление развития рынка: лучшая модель — не обязательно самая мощная, а та, которая хорошо справляется с работой по разумной цене. Haiku 5.5, следующая модель серии, выход которой ожидается в ближайшие недели, может ускорить этот сдвиг еще сильнее, сделав выполнение крупномасштабных задач ИИ дешевле — и усложнив для компаний обоснование премиальных цен за рутинные задачи.