米ラボがAIランキングを牽引、Anthropic・OpenAI・Googleが上位を独占
重要ポイント
- •AnthropicのClaude Fable 5.1(Max)、Claude Opus 5.5、Claude Sonnet 5.5がAgent Arenaランキングの上位を占めています。
- •OpenAIのGPT-6 AstraとGPT-6.1 SolがAnthropicのモデルに続き、GPT-6.1 Solは印象的な正味改善スコアでランキングにランクインしました。
- •GoogleのGemini 4 Argonがトップ10を締めくくり、米国の研究機関によるランキング上位独占が完成しました。
- •ランキングはコード、チャット、ワークの各カテゴリーにまたがっており、上位の座は単一ベンチマークの強さではなく、タスクタイプの幅広さを反映しています。
- •Anthropic、OpenAI、Googleの今後のリリースや、MetaとAlibabaの潜在的な動きにより、2026年10月末から11月にかけて順位が変わる可能性が見込まれています。

最新のAgent Arenaランキングでは、自律的に計画を立て複数ステップのタスクを実行できるモデルを対象とするAI分野であるエージェント型問題解決において、米国の研究機関が最前線に立っていることが示されました。Anthropic、OpenAI、Googleがコード、チャット、ワークの各カテゴリーで上位の座を維持しています。
AnthropicのモデルであるClaude Fable 5.1(Max)、Claude Opus 5.5、Claude Sonnet 5.5がランキングのトップを占め、OpenAIのGPT-6 AstraとGPT6.1 Solが続いています。GoogleのGemini 4 Argonがトップ10を締めくくっています。この順位は、先進的なAIモデルの開発において現在米国のラボが支配的な地位にある、非常に競争の激しい分野であることを示しています。Anthropic、OpenAI、Googleは、それぞれClaude、GPT、Geminiモデルファミリーを手がける、米国を拠点とする最も著名なAI開発企業です。ランキングはコーディング、会話、業務向けタスクにまたがっているため、3カテゴリーすべてで上位を維持していることは、単一のベンチマークにおける強さではなく、タスクタイプの幅広さを示すものです。
ランキングは動的であり、最近の進展を反映しています。その一例がOpenAIのGPT-6.1 Solのランクインで、同モデルは印象的な正味改善スコアでランキングに加わりました。新しいモデルの登場によって順位がいかに速く動くかを思い起こさせます。
ランキングが示す米国のリーダーシップ
現在の順位は、AIモデル分野における米国の研究機関、とりわけAnthropic、OpenAI、Googleの地位を補強するものと言えます。Anthropicがランキング上位に居続けていることは、複数のカテゴリーにわたるエージェント型問題解決での強さと一致しています。
モデル業界を追う開発者や企業にとって、こうしたランキングはフロンティアモデルをエージェント型タスクで比較するための、共有された定期的更新の参考指標として機能します。
価格設定からは、主要AIモデル間の競争が依然として激しいため、ランキングが変動する可能性が示唆されています。
注目ポイント
Anthropic、OpenAI、GoogleといったAI大手の今後のリリースとアップデートに注目が集まる見込みです。ランキングが動的な性質を持つ以上、重要な進展や新モデルのリリースによって現在の順が変わる可能性があります。
また、LlamaとQwenの各モデルファミリーを手がけるMetaやAlibabaといった他の競合企業の動向にも注目が集まっており、これらの動きが市場全体の構図に影響を与え、2026年10月末から11月にかけてランキングを左右する可能性があります。