Anthropic представила Claude Opus 5: почти передовой уровень ИИ за половину стоимости для корпоративных и программных задач
Ключевые выводы
- •Opus 5 стоит столько же, сколько Opus 4.8, при этом Anthropic заявляет, что модель обеспечивает почти весь интеллект Fable 5 за половину стоимости.
- •Anthropic сообщает, что Opus 5 набрала 43.3% в Frontier-Bench v0.1 против 18.7% у Opus 4.8 и 33.7% у Fable 5.
- •Компания утверждает, что Fable 5 по-прежнему лучше подходит для самых долгих автономных проектов, тогда как Opus 5 сильнее в ограниченных задачах с конкретным результатом.
- •Первые клиенты отметили меньшее использование токенов, меньше вызовов инструментов, более быстрое выполнение и более высокую результативность в юридических, финансовых, автоматизационных и программных рабочих процессах.
- •Opus 5 включает классификаторы безопасности, fallback-маршрутизацию к Opus 4.8 в отдельных продуктах, режим Fast, доступ через API и отсутствие требований к хранению данных для общего доступа.

Anthropic в пятницу выпустила Claude Opus 5 — модель, которая, по утверждению компании, обеспечивает почти весь интеллект флагманской Claude Fable 5 за половину стоимости. Этот запуск подчеркивает, как конкурентная среда в сфере ИИ смещается от чистой мощности к экономике повседневного использования.
Модель уже доступна на всех платформах Anthropic. Ее цена составляет $5 за миллион входных токенов и $25 за миллион выходных токенов — без изменений по сравнению с предшественником, Opus 4.8. Opus 5 становится новой моделью по умолчанию в Claude Max, премиальном потребительском тарифе Anthropic, и самой мощной моделью, доступной в Claude Pro.
Такое позиционирование выбрано намеренно. Anthropic не утверждает, что Opus 5 является ее самой умной моделью — это звание по-прежнему принадлежит Fable 5, а конкурирующие системы сохраняют преимущество в отдельных областях. Вместо этого компания продвигает более тонкий аргумент, прямо адресованный корпоративным покупателям: наиболее экономически значимая работа ИИ находится в средней зоне сложности, где интеллект почти передового уровня, предоставляемый эффективно и доступно, превосходит передовой интеллект, поставляемый по премиальной цене.
"Opus 5 as your daily driver, the model you hand complex work to and review when it's done," — сказал представитель Anthropic в интервью VentureBeat, описывая стратификацию модельной линейки компании. "Fable 5 for your most ambitious work, the days-long autonomous projects nothing could take on before... Sonnet 5 for work you run at scale, where speed and cost per call decide what ships. Haiku 4.5 for subagents and instant answers."
Результаты бенчмарков: Opus 5 против Fable 5 и конкурентов
На бумаге результаты бенчмарков выглядят впечатляюще. Anthropic заявляет, что Opus 5 устанавливает новые показатели уровня state-of-the-art в оценках по программированию и интеллектуальной работе, включая Frontier-Bench и GDPval-AA.
В Frontier-Bench v0.1, бенчмарке агентного программирования в терминале, Opus 5 набирает 43.3 percent — более чем вдвое выше результата Opus 4.8 в 18.7 percent и значительно выше 33.7 percent у Fable 5 — при более низкой стоимости на задачу, по данным компании. В ARC-AGI 3, оценке решения новых задач, Anthropic сообщает, что Opus 5 набрала результат втрое выше, чем следующая лучшая модель. В OSWorld 2.0, бенчмарке использования компьютера, компания утверждает, что Opus 5 превосходит лучший результат Fable 5 при стоимости чуть выше одной трети.
Эти цифры сопровождаются оговорками, которые сами по себе примечательны в отрасли, склонной к превосходным степеням. Anthropic признает, что Opus 5 по-прежнему уступает Mythos 5, конкурирующей модели, в задачах кибербезопасности и биологических исследованиях. Одна модель семейства OpenAI все еще лидирует в одном бенчмарке агентного программирования.
Более показательная оговорка прозвучала непосредственно от Anthropic, когда компанию спросили, в чем Opus 5 все еще уступает Fable 5. Ответ представителя стал откровенным признанием того, что бенчмарки могут и не могут измерить.
"The evals where Opus 5 wins are bounded tasks with a specific outcome, which is where it's strongest. What those evals don't measure is duration," — сказал представитель VentureBeat. "One way to put it: Opus 5 is the best tool for the jobs benchmarks can see, and Fable 5 is what you reach for when the job outruns the benchmark."
Fable 5, напротив, "is for the longest, most autonomous jobs, where the model has to stay coherent across many connected steps over hours or days with dense source material," — сказал представитель, посоветовав клиентам "run both on a representative workload, one bounded task and one long-horizon job." Такая рамка — ограниченные задачи против долгосрочной автономности — может стать определяющей осью дифференциации моделей в 2026 году, по мере насыщения бенчмарков и смещения самых сложных оставшихся проблем к устойчивой многодневной агентной работе, а не к отдельным головоломкам.
Эффективность токенов как реальное поле конкуренции в корпоративном ИИ
Через весь запуск проходит тема, которую Anthropic явно хочет донести до покупателей: Opus 5 не просто хорошо набирает баллы, она хорошо набирает баллы в пересчете на доллар. Модель поставляется с настраиваемым параметром "effort", который позволяет клиентам обменивать уровень интеллекта на скорость и экономию токенов, а графики Anthropic подчеркивают производительность при заданной стоимости, а не только пиковую производительность.
Первые клиенты подтвердили этот тезис с необычной конкретикой. Harvey, компания в сфере юридического ИИ, заявила, что Opus 5 достигла сопоставимой производительности с режимом максимального рассуждения Opus 4.8, "while generating 26% fewer tokens on average," по словам Niko Grupen, руководителя прикладных исследований. Richard Pham из Fundamental Research Lab сообщил, что на сложных задачах финансового моделирования модель в среднем давала точность на девять процентных пунктов выше, "while using roughly one-third fewer turns and tool calls and 60% less time."
Wade Foster, генеральный директор Zapier, сказал, что Opus 5 возглавила таблицу лидеров AutomationBench его компании, "without spending more tokens than prior Claude models," выполняя полный процесс предотвращения оттока клиентов от начала до конца. "Previous models didn't pass; Opus 5 hit 100%," — сказал он.
Scott Wu, генеральный директор Cognition, компании, стоящей за агентом программирования Devin, сказал, что на FrontierCode 1.1 "Claude Opus 5 approaches Fable-level performance at half the cost," особенно сильно проявляя себя в отладке и анализе первопричин.
Акцент на эффективности отражает коммерческую реальность. Расходы предприятий на ИИ больше не являются экспериментальными, а затраты на инференс — стоимость фактического запуска моделей в масштабе — стали вопросом уровня совета директоров. Бизнес Anthropic в значительной степени ориентирован на API и корпоративное использование; согласно анализу Contrary Research за февраль 2026 года, Claude занимал около 40 percent корпоративного рынка больших языковых моделей по использованию на конец 2025 года, а Claude Code сам по себе достиг примерно $1 billion годовой выручки в пересчете на год. Для компании, клиенты которой платят за токены, модель, делающая больше с меньшим числом токенов, — не приятное дополнение, а сам продукт.
Самопроверяющиеся агенты и скрытые издержки автоматизации
Помимо цифр, Anthropic продвигает поведенческий нарратив: Opus 5 проверяет собственную работу и итеративно дорабатывает ее до успеха. Компания привела несколько примеров из тестирования, которые напоминают небольшие притчи о машинной настойчивости.
В одной задаче Frontier-Bench модели нужно было восстановить деталь машины в виде 3D CAD-модели по чертежу, который ей намеренно не дали возможности просмотреть. Вместо того чтобы провалиться, как утверждает Anthropic, Opus 5 написала собственный конвейер компьютерного зрения для извлечения геометрии из сырых пикселей — и делала это неоднократно, тогда как ни одна конкурирующая модель не решила задачу за пять попыток. В другом случае, получив реальный баг в популярном пакетном менеджере с открытым исходным кодом, модель нашла первопричину и исправила пограничный случай, который пропустил собственный патч сообщества; конкурирующая модель исправила только симптом и объявила победу. Инженер торговой фирмы, по словам компании, использовал Opus 5, чтобы за одну сессию построить поток рыночных данных для новой биржи, а когда не нашлось живого потока для проверки, увидел, как модель создала собственный тестовый стенд для проверки кода парсинга.
Клиенты описывали похожее поведение в рабочих условиях. Cristian Rivera, штатный software engineer в Stripe, сказал, что на выходные дал модели "a chief-of-staff role over my dev environments": "it built its own monitor, drove each box, and pulled me in only for the judgment calls."
Именно эта способность наиболее важна для предприятий. Разрыв между моделью, которая выдает правдоподобный результат, и моделью, которая проверяет свой результат, — это разрыв между демонстрацией и системой, пригодной к развертыванию. Большая часть скрытых затрат корпоративного ИИ сегодня — это человеческая проверка: инженеры проверяют работу машины. Модель, которая надежно проверяет собственную работу, сокращает эти затраты, и именно поэтому клиенты продолжают говорить о меньшем числе итераций, меньшем числе проходов и меньшем времени, а не о более высоких сырых баллах.
Стратегия безопасности Anthropic: разрывы в возможностях, классификаторы и переключение моделей
Запуск также подчеркивает все более сложный подход Anthropic к безопасности — теперь он включает намеренное необучение моделей определенным навыкам. Компания утверждает, что ее автоматизированный поведенческий аудит признал Opus 5 самой согласованной с целями безопасности моделью на сегодняшний день: общий показатель несогласованного поведения составил 2.3, ниже, чем у Opus 4.8, Sonnet 5 или Fable 5, при самых низких уровнях обманного поведения и наименьшей восприимчивости к попыткам склонить модель к неправомерному использованию.
Со стороны возможностей Anthropic заявляет, что намеренно избегала обучения Opus 5 на киберзадачах, как и в случае с Opus 4.8. Тем не менее модель все равно улучшилась в них — как побочный эффект общего роста возможностей — и теперь почти сравнялась с Mythos 5 в поиске уязвимостей ПО. Но она значительно отстает в их эксплуатации: в оценке OSS-Fuzz от Anthropic Opus 5 выявляла уязвимости с частотой 79.4 percent, близко к 80 percent у Mythos 5, но успешно разработала эксплойты только в 4 задачах против 13 у Mythos 5. Такая асимметрия — сильна в обнаружении, релевантном для защиты, и слаба в эксплуатации, релевантной для нападения, — выглядит намеренной, и защитные меры следуют той же логике. Anthropic ожидает, что киберклассификаторы Opus 5 будут вмешиваться примерно на 85 percent реже, чем у Fable 5.
Когда классификатор все же срабатывает, запросы в Claude.ai, Claude Code и Claude Cowork по умолчанию переключаются на Opus 4.8 — что поднимает очевидный вопрос: если запрос слишком рискован для одной модели, почему он приемлем для другой?
"The model it falls back to has lower capability levels making the risk of harmful use lower as well," — сказал представитель, добавив, что "there is a message that lets the user know when this occurs and is visible in the chat." Эта логика защитима, но она показывает, как безопасность ИИ работает в 2026 году: риск не является свойством одного только вопроса, а возникает из произведения вопроса на возможности системы, которая на него отвечает.
В биологии расчет идет в другую сторону. Opus 5 теперь является самой мощной общедоступной моделью Anthropic для научных исследований — ее результат на внутреннем химическом бенчмарке компании на 10.2 процентного пункта выше, чем у Opus 4.8, — хотя представитель признал, что "Mythos 5 remains the stronger model for long-horizon, open-ended work like autonomous drug design campaigns."
Деловые ставки: оценка в $380 billion и крупные обязательства по вычислениям
Запуск происходит в момент исключительного коммерческого импульса — и исключительных обязательств — для Anthropic. Reuters сообщило в феврале, что компания была оценена примерно в $380 billion в последнем раунде финансирования. Согласно анализу Contrary Research, годовая выручка в пересчете на год выросла примерно с $1 billion в конце 2024 года до прогнозируемых $9 billion к концу 2025 года, а внутренние цели, как сообщается, достигали $20 to $26 billion на 2026 год.
Эти цели подкреплены огромными инфраструктурными обязательствами, включая, как сообщалось, сделку на $30 billion по вычислениям Azure, а также договоренности с Google Cloud и Nvidia — расходы, которые оправданы только при дальнейшем расширении корпоративного использования.
В этом контексте ценовая стратегия Opus 5 выглядит понятной. Сохранение цены на уровне Opus 4.8 при примерно двукратном росте производительности в ключевых агентных бенчмарках фактически означает резкое снижение цены за единицу возможностей, призванное расширить круг рабочих нагрузок, которые экономически целесообразно автоматизировать. Каждая задача, находившаяся на грани рентабельности при стоимости успеха Opus 4.8, становится жизнеспособной при Opus 5 — а каждая жизнеспособная задача означает повторяющуюся токеновую выручку.
Регуляторный фон также стал более сложным. Судья в США на этой неделе окончательно одобрил урегулирование Anthropic на $1.5 billion по иску о нарушении авторских прав с авторами книг, сообщило Reuters, закрыв главу судебных споров вокруг ранних обучающих данных компании. В июне Reuters со ссылкой на Axios сообщило, что правительство США предприняло шаги для блокировки иностранного доступа к самым продвинутым моделям Anthropic — напоминание о том, что передовой ИИ теперь связан с экспортной политикой, влияющей на то, какие клиенты что могут приобрести.
Дополнительные функции и доступность
Также в пятницу запускаются: режим Fast, работающий примерно в 2.5 раза быстрее стандартного при двойной базовой цене, автоматическая маршрутизация fallback в API и изменения инструментов в середине диалога, которые больше не инвалидируют кэш промпта, — небольшая функция, которую разработчики агентов могут оценить выше любого бенчмарка.
Как и предыдущие модели Opus, Opus 5 не предъявляет требований к хранению данных для общего доступа — представитель отдельно отметил это для клиентов с "a hard zero data retention requirement." Разработчики могут получить доступ к модели как claude-opus-5 через Claude API начиная с сегодняшнего дня.
Два вопроса определят, оправдается ли эта ставка: выдержат ли заявления Opus 5 об эффективности столкновение с производственными нагрузками в масштабе и примут ли предприятия мир, в котором классификаторы безопасности, а не пользователи, иногда решают, какая модель отвечает.
Более глубокий сигнал пятничного запуска состоит в том, что центр тяжести индустрии ИИ сместился. На протяжении трех лет лаборатории конкурировали в том, что их лучшая модель способна сделать в свой лучший день. С Opus 5 Anthropic конкурирует в менее эффектной, но куда более прибыльной области: что очень хорошая модель может делать каждый день за половину цены. На рынке, где передовой рубеж продолжает двигаться вперед, Anthropic делает ставку на то, что настоящее состояние находится чуть позади него.