ニュース株式MetaがMuse Codeベータ版を公開、Claude Opus 5はベンチマークでリードを維持

MetaがMuse Codeベータ版を公開、Claude Opus 5はベンチマークでリードを維持

著者: Cryptopolitan·

重要ポイント

  • MetaはMuse Spark 1.2モデルを搭載したターミナルベースのコーディングエージェント「Muse Code」のベータ版を公開した。Muse Spark 1.2はOpenAIのCodexとGoogleのAntigravityの大部分のコーディングベンチマークを上回る一方、AnthropicのClaude Opus 5に対してはMetaが公開したすべてのベンチマークで劣後している。
  • Muse Codeは、すべてのモデル呼び出し、ツール実行、承認、編集を記録するローカルイベントログを保持しており、クラッシュ発生時にも長時間実行タスクをシームレスに再開できる。
  • エージェントは隔離されたワークツリーで並列サブエージェントを展開でき、開発者のワーキングコピーは一切触れられない。ゲームの機能を6つ同時に構築しても衝突が起きないことが実証されている。
  • Metaはトップのベンチマーク性能ではなく価格で競合しており、ベンチマーク首位を獲得できないプロバイダーがコスト、オープン性、または統合の深さで差別化するという市場の広範な傾向と一致している。
  • Watermelonというコードネームのより大型Meta AIモデルは現在もトレーニング中であり、同社は投資家に対し、今年はチップ、データセンター、関連インフラに1250億〜1450億ドルを投じる見込みであると伝えている。
MetaがMuse Codeベータ版を公開、Claude Opus 5はベンチマークでリードを維持

Metaは水曜日に、ターミナルベースのコーディングエージェント「Muse Code(ベータ版)」を公開しました。この発表により、Metaは急速に成長するAIコーディングツール分野の競合各社 — OpenAIのCodex、GoogleのAntigravity、AnthropicのClaude、そしてCursorやDevinなどの独立系エージェント — と直接競合することになります。開発者がマルチファイルのエンジニアリング作業を自律型モデルに委ねる動きが広がる中での参入です。Meta自身の図表によると、同モデルはOpenAIのCodexとGoogleのAntigravityの大部分のコーディングテストを上回っていますが、AnthropicのClaude Opus 5に対してはMetaが公開したすべてのベンチマークで劣後しています。

Muse CodeはOpus 5に及ばないものの、クラッシュセーフなログを追加

Muse Codeは、Metaが7月に米国の開発者向けに公開したコーディングモデルのアップデート「Muse Spark 1.2」を搭載しています。

Metaが提示したベンチマークでは、Muse Spark 1.2はOpus 5に遅れをとるものの、CodexとAntigravityの大部分のテストで優位に立ちました。Metaはこのモデルについて、「より大型で能力の高いモデルを順次投入しながら、フロンティアに向けた次のステップ」であると述べました。

同社によると、トレーニング中にコーディングタスクに充てるコンピュート量を増やしたことで、バージョン1.2はコード生成、デバッグ、大規模コードベースの理解において向上しています。

ある事例では、既存のライブラリからのコピーを禁止されたベースラインをもとに、1000回以上のツール呼び出しと最長24時間をかけて、NVIDIA Hopperチップ向けのGPUカーネルを書き直しました。

Muse Codeは、すべてのモデル呼び出し、ツール実行、承認、編集を記録するローカルイベントログを保持しています。「この単一の信頼できる情報源により、ランタイムは正確に再生可能で再起動安全になります」と、Metaはログに関するブログ投稿で述べています。

クラッシュが発生した場合、エージェントは停止した箇所から再開できます。また、エージェントはセッション全体を通じてバックグラウンドのサブエージェントを実行し続けます。この耐障害性は、1回の障害が何時間ものコンピュートを無駄にしかねない長時間実行タスクにおいて重要です。

MetaのCEOであるMark Zuckerbergは投稿の中で次のように述べています。「十分に大きなジョブの場合、並行して作業する別々のサブエージェントが隔離されたワークツリーに分散します。」さらに、「あなたのワーキングコピーは一切触れられません。テストでは、衝突なしにゲームの6つの機能を同時に構築させました。」と付け加えました。

Releasing Muse Code in beta today. It's a terminal coding agent that takes on complete software engineering tasks across large repos: planning changes, writing code, validating the results. Powered by Muse Spark 1.2, a coding-focused model update. pic.twitter.com/xqavk41w6v — Mark Zuckerberg (@finkd) August 5, 2026

/plan、/grill、そしてMetaの価格勝負

Muse Codeには複数の組み込みコマンドが用意されています。/planはリクエストを承認ゲート付きの計画に変換し、/grillは計画が成り立つまでストレステストを行い、/goalは設定された目標の完了に向けて推進します。

開発者はmacOSまたはLinux上で単一のcurlコマンドによりエージェントをインストールできます。Muse Spark 1.2はMeta Model APIからも利用可能です。

モデルとエージェントは連携するように設計されており、Muse Codeのツールセットが両者の互換性を維持します。

トレーニングデータの一部は、旧バージョンのMuse Spark 1.1によって生成されました。Muse Spark 1.1は難易度の高いコーディング問題を生成し、候補となる回答を採点しました。Metaはこのループにより、新しいモデルが指示により正確に従えるようになったとしています。

Metaは投資家に対し、今年はチップ、データセンター、その他のインフラに1250億〜1450億ドルを投じる見込みであると伝えています。

Opus 5にはベンチマークで追いつけない中、同社は価格で勝負する戦略をとっています。このアプローチは、AIモデル市場におけるより広範な傾向を反映しています。トップのベンチマーク順位を獲得できないプロバイダーは、コスト、オープン性、または統合の深さで差別化しています。Watermelonというコードネームのより大型Meta AIモデルは、現在もトレーニング中です。

If you're reading this, you're already ahead. Stay there with our newsletter.