НовостиМакроClaude Opus 5 от Anthropic превзошел Fable 5 в большинстве бенчмарков при вдвое меньшей цене

Claude Opus 5 от Anthropic превзошел Fable 5 в большинстве бенчмарков при вдвое меньшей цене

Автор: Decrypt·

Ключевые выводы

  • Claude Opus 5 была запущена 24 июля по цене $5 за миллион входных токенов, ровно вдвое дешевле Fable 5, при этом превзойдя ее почти во всех крупных бенчмарках.
  • Opus 5 теперь является моделью по умолчанию в Claude Max и самым мощным вариантом в Claude Pro, фактически заменяя Fable 5 в роли флагмана Anthropic для подписчиков после экспортных ограничений и перехода Fable 5 на доступ только за кредиты.
  • В Frontier-Bench v0.1 Opus 5 достигла 43.3%, превысив результаты Fable 5 на уровне 33.7% и GPT-5.6 Sol от OpenAI на уровне 34.4% в задачах сквозной разработки программного обеспечения.
  • Lovable сообщила об улучшении на 22% по сравнению с Opus 4.7 в агентных задачах программирования, а Zapier зафиксировала идеальный результат Opus 5 в AutomationBench на полном рабочем процессе предотвращения оттока клиентов.
  • Релиз состоялся через неделю после того, как пекинская Moonshot AI представила Kimi K3, модель с открытыми весами на 2.8 трлн параметров, которую независимые бенчмарки ставят на третье место в общем рейтинге после Fable 5 и GPT-5.6 Sol.
Claude Opus 5 от Anthropic превзошел Fable 5 в большинстве бенчмарков при вдвое меньшей цене

Anthropic выпустила Claude Opus 5 24 июля по цене $5 за миллион входных токенов — столько же, сколько стоила предыдущая Opus 4.8, и ровно вдвое дешевле Fable 5, — при этом новая модель превзошла Fable 5 в большинстве крупных бенчмарков. Теперь модель используется по умолчанию в Claude Max и является самым мощным вариантом в Claude Pro, фактически заменяя Fable 5 как основной выбор для большинства подписчиков.

Opus 5 дешевле в эксплуатации для бизнеса, чем ведущая модель Anthropic, Claude Fable 5, которую компания позиционировала как повседневный frontier-продукт для платных пользователей. Кроме того, Opus 5 превосходит Fable 5 в нескольких значимых бенчмарках. Для компаний, создающих продукты на базе AI API, где затраты на токены напрямую масштабируются вместе с числом пользователей, модель, которая соответствует frontier-производительности или превосходит ее при вдвое меньшей цене, может существенно изменить юнит-экономику.

Структура уровней моделей Anthropic

Линейка Anthropic включает четыре уровня. Haiku — быстрая и недорогая модель. Sonnet занимает средний сегмент. Opus выступает как мощная рабочая модель для тяжелых задач. Над ними находится класс Mythos — уровень, который Anthropic представила этой весной; он включает Claude Fable 5 для широкой аудитории и Claude Mythos 5, версию с меньшим числом ограничений, доступную через Project Glasswing проверенным исследователям в области кибербезопасности и операторам критической инфраструктуры.

Период Fable 5 в роли флагмана для подписчиков оказался нестабильным. Модель была запущена 9 июня, но уже через три дня была снята с доступа по всему миру после того, как правительство США выпустило экстренный приказ об экспортном контроле, сославшись на уязвимость jailbreak. Она вернулась 30 июня, но сразу перешла на модель доступа только за кредиты и больше не входила в стандартные планы. Теперь Opus 5 занимает место, которое Fable 5 удержать не смогла.

Lovable, платформа для разработчиков с миллионами пользователей, протестировала Opus 5 во внутренних оценках и отметила, что улучшения выходят за рамки сырых показателей. "It isn't just better on our hardest agentic coding tasks, up 22% over Opus 4.7, it's steadier, with far less variance run to run," — сказал Fabian Hedin в заявлении, предоставленном Anthropic.

Результаты бенчмарков

Opus 5 превосходит Fable 5 почти по всем метрикам, важным для повседневных пользователей, несмотря на то что не относится к классу Mythos.

В Frontier-Bench v0.1 — бенчмарке, проверяющем, способны ли AI-агенты для программирования выполнять реальные задачи software engineering от начала до конца, с оценкой в процентах успешно выполненных задач, — Opus 5 достигла 43.3%. Fable 5 набрала 33.7%, а GPT-5.6 Sol от OpenAI, основной коммерческий конкурент Anthropic, получила 34.4%.

Самый большой разрыв был зафиксирован в ARC-AGI-3 — тесте на подлинное решение задач, построенном вокруг новых головоломок, которые модель не могла запомнить из обучающих данных, с оценкой в процентах решенных задач. Opus 5 показала 30.2%; GPT-5.6 Sol набрала 7.8%; Fable 5 в этом тесте вообще не оценивалась.

В GDPval-AA v2 — бенчмарке для работы со знаниями, оцениваемом через рейтинг Elo, шахматную систему ранжирования, используемую для измерения относительной эффективности на реальных профессиональных задачах, — Opus 5 достигла 1,861 против 1,747 у Fable 5 и 1,736 у GPT-5.6 Sol.

Zapier протестировала Opus 5 в AutomationBench — оценке, которая показывает, может ли модель провести полный бизнес-процесс от начала до конца без вмешательства человека. Их вывод: модель "took a raw account-health workbook and ran a full churn-prevention sequence end to end: flagging at-risk accounts, alerting the right owner, and summarizing for retention ops. Previous models didn't pass; Opus 5 hit 100%."

Anthropic также позиционирует Opus 5 как улучшение для исследовательских задач. Ultima Genomics, компания в области секвенирования ДНК, заявила, что модель "behaves more like a careful scientist than any model we've run. It reaches for the right statistical tests to rule out confounders, cross-checks its own results by independent methods, and stays on track through long multi-step analyses."

При этом юридическая сфера и здравоохранение остаются единственными двумя областями, где Fable 5 имеет небольшое преимущество.

Более широкий конкурентный контекст

Релиз состоялся через неделю после того, как Moonshot AI, пекинский стартап при поддержке Alibaba, представила Kimi K3 — модель с открытыми весами на 2.8 трлн параметров, то есть любой может скачать базовый код и запускать ее самостоятельно. Moonshot называет ее крупнейшей в мире открытой AI-системой. Независимые бенчмарки стабильно ставят Kimi K3 на третье место в общем рейтинге после Fable 5 и GPT-5.6 Sol, хотя в отдельных областях она превосходит обе модели. Подход с открытыми весами, отличающийся от модели доступа только через API, которую используют Anthropic и OpenAI, позволяет организациям запускать модели на собственном оборудовании, хотя система на 2.8 трлн параметров требует значительных вычислительных ресурсов для работы.

Цены и доступность

Opus 5 уже доступна через API по цене $5 за миллион входных токенов и $25 за миллион выходных токенов. (Токены — базовые единицы информации, которые AI-модель обрабатывает как на входе, так и на выходе.) Также доступен режим Fast, работающий примерно в 2.5 раза быстрее стандартного, по цене вдвое выше базовой — $10 за миллион входных токенов и $50 за миллион выходных.

Релиз может снизить сохраняющиеся опасения по поводу ограниченной публичной доступности Fable 5. Opus 5 также доступна всем пользователям по подписке.