企业测试 Codex,但 Claude Code 仍是工程师的首选
要点速览
- •到 2026 年 2 月,Claude Code 约占公共 GitHub 提交量的 4%,并在 2026 年 3 月中旬达到单日 326,000 次提交的峰值。
- •Claude Code 在验证基准测试中的得分为 72.7%,高于 Codex 的 69.1%。
- •开发者报告指出,Claude Code 在长时间、多步骤编码会话、UI 工作和插件支持任务方面表现尤为出色。
- •Codex 在范围明确的委派式工作中更具效率优势,因为其单任务成本可能更低。
- •金融服务、医疗技术及其他受监管行业的企业正在越来越多地采用 Claude Code,并经常与 Codex 一起用于混合工作流。

在评估最新一代 AI 编码代理的企业工程团队中,Anthropic 的 Claude Code 已经成为开发者真正想使用的工具。OpenAI 的 Codex 正在获得大量试用,但当工程师拥有选择权时,Claude Code 仍持续获得支持,这也表明其采用不仅取决于模型质量,还取决于日常工作流的契合度和任务复杂度。
数据说明了一切
到 2026 年 2 月,Claude Code 约占所有公开 GitHub 提交量的 4%,平均每天约有 135,000 次提交。到 2026 年 3 月中旬,这一数字上升至单日峰值 326,000 次提交。
在经过验证的基准测试中,Claude Code 的得分为 72.7%,高于 Codex 的 69.1%。
2026 年期间的开发者报告反复强调了 Claude Code 在长会话上下文中的优势,即那种需要 AI 代理记住 40 步之前做了什么而又不丢失上下文的多步骤、长时段编码工作。它在与 UI 相关的任务以及插件生态方面也获得了较高评价。
不过,Codex 在一个方面具有优势:单任务成本效率。对于范围明确、相对封闭的委派式工作,Codex 可能是更经济的选择。
企业采用正在发生变化
据报道,自 2025 年初开始,Anthropic 在企业采用指标上已经超过 OpenAI,尤其是在开发者满意度和代理式任务完成率方面。
Claude Code 正在企业合同中获得更多采用,尤其是在对输出一致性和合规性要求较高的环境中。金融服务、医疗技术以及受监管行业正在转向 Anthropic 的产品。
一些公司也在低调采用混合工作流,根据任务不同同时部署两种工具。Claude Code 负责更复杂、上下文更密集的工作,Codex 则处理更常规、对成本更敏感的任务。