Meta запускает бета-версию Muse Code, пока Claude Opus 5 лидирует в бенчмарках
Ключевые выводы
- •Meta выпустила Muse Code в бета-версии — терминальный агент для программирования на базе модели Muse Spark 1.2, который превосходит Codex от OpenAI и Antigravity от Google по большинству бенчмарков программирования, но уступает Claude Opus 5 от Anthropic по всем опубликованным Meta бенчмаркам.
- •Muse Code ведёт локальный журнал событий, фиксирующий все вызовы модели, запуски инструментов, утверждения и правки, что позволяет агенту без проблем возобновлять работу после сбоев при выполнении длительных задач.
- •Агент может распределять работу между параллельными подагентами в изолированных рабочих деревьях, так что рабочая копия разработчика остаётся нетронутой — это было продемонстрировано при одновременной разработке шести функций игры без конфликтов.
- •Meta конкурирует на основе цены, а не за счёт максимальной производительности в бенчмарках, что отражает более широкую рыночную тенденцию, где поставщики дифференцируются по стоимости, открытости или глубине интеграции, когда не могут претендовать на лидерство в бенчмарках.
- •Более крупная ИИ-модель Meta под кодовым названием Watermelon всё ещё находится в процессе обучения, а компания сообщила инвесторам, что ожидает потратить от 125 до 145 млрд долларов в этом году на чипы, центры обработки данных и сопутствующую инфраструктуру.

Meta выпустила Muse Code (бета) — терминальный агент для программирования — в среду. Этот запуск ставит Meta в прямую конкуренцию с быстрорастущим сегментом ИИ-инструментов для программирования, включая Codex от OpenAI, Antigravity от Google, Claude от Anthropic и независимые агенты вроде Cursor и Devin, по мере того как разработчики всё чаще делегируют автономным моделям инженерные задачи, охватывающие множество файлов. Собственные графики Meta показывают, что модель превосходит Codex от OpenAI и Antigravity от Google по большинству тестов программирования, но уступает Claude Opus 5 от Anthropic по всем опубликованным Meta бенчмаркам.
Muse Code уступает Opus 5, но добавляет отказоустойчивый журнал
Muse Code работает на базе Muse Spark 1.2 — обновления модели для программирования, которую Meta открыла для разработчиков в США в июле.
По представленным Meta бенчмаркам, Muse Spark 1.2 уступает Opus 5, но превосходит Codex и Antigravity по большинству тестов. Meta описала модель как свой «следующий шаг к рубежу, с более крупными и значительно более мощными моделями на подходе».
Компания сообщила, что версия 1.2 лучше справляется с генерацией кода, отладкой и пониманием больших кодовых баз после того, как в ходе обучения было увеличено количество вычислительных ресурсов, выделенных на задачи программирования.
В одном из примеров использования модель переписала GPU-ядра для чипов NVIDIA Hopper посредством более 1000 вызовов инструментов в течение 24 часов, работая на основе базового кода, с инструкцией не копировать из существующих библиотек.
Muse Code ведёт локальный журнал событий, в котором фиксируются все вызовы модели, запуски инструментов, утверждения и правки. «Этот единый источник истины делает среду выполнения точно воспроизводимой и устойчивой к перезапуску», — написала Meta в своём блоге, описывая журнал.
В случае сбоя агент может возобновить работу с того места, где он остановился. Агент также поддерживает фоновые подагенты на протяжении всего сеанса. Такая устойчивость важна для длительных задач, где единичный сбой может иначе стоить часов вычислений.
Марк Цукерберг, генеральный директор Meta, написал в публикации: «Когда задача достаточно масштабная, она распределяется между отдельными подагентами, работающими параллельно в изолированных рабочих деревьях». Он добавил: «Ваша рабочая копия остаётся нетронутой. При тестировании мы поручили ему одновременно разработать шесть функций для игры без каких-либо конфликтов».
Releasing Muse Code in beta today. It's a terminal coding agent that takes on complete software engineering tasks across large repos: planning changes, writing code, validating the results. Powered by Muse Spark 1.2, a coding-focused model update. pic.twitter.com/xqavk41w6v — Mark Zuckerberg (@finkd) August 5, 2026
/plan, /grill и ставка Meta на стоимость
Muse Code включает несколько встроенных команд. /plan превращает запрос в план, требующий утверждения, /grill подвергает этот план стресс-тестированию до тех пор, пока он не станет устойчивым, а /goal направляет работу на достижение заявленной цели.
Разработчики могут установить агент на macOS или Linux одной командой curl. Muse Spark 1.2 также доступен через Meta Model API.
Модель и агент разработаны для совместной работы, а набор инструментов Muse Code обеспечивает их совместимость.
Часть обучающих данных была создана более старой моделью Muse Spark 1.1, которая генерировала сложные задачи по программированию и оценивала ответы кандидатов. Meta сообщила, что этот цикл помог новой модели точнее следовать инструкциям.
Meta сообщает инвесторам, что ожидает потратить от 125 до 145 млрд долларов в этом году на чипы, центры обработки данных и прочую инфраструктуру.
Поскольку Opus 5 недостижим по бенчмаркам, компания конкурирует на основе цены. Этот подход отражает более широкую тенденцию на рынке ИИ-моделей, где поставщики, не способные претендовать на верхнюю строчку в бенчмарках, дифференцируются за счёт стоимости, открытости или глубины интеграции. Более крупная ИИ-модель Meta под кодовым названием Watermelon всё ещё находится в процессе обучения.
Если вы читаете это, вы уже на шаг впереди. Оставайтесь там с нашей рассылкой.