新闻股票Anthropic Claude Code 2.1.277 采纳 OpenAI 主导的 AGENTS.md 标准

Anthropic Claude Code 2.1.277 采纳 OpenAI 主导的 AGENTS.md 标准

作者: Coinotag·

要点速览

  • Claude Code 2.1.277 版本现在在没有 CLAUDE.md 的情况下会将厂商中立的 AGENTS.md 文件作为回退读取,同时维护两个文件的团队可以通过 /config 面板并行加载它们。
  • OpenAI 于 2025 年 8 月推出 AGENTS.md,并将其捐赠给 Linux 基金会旗下的 Agentic AI Foundation,记录显示已有超过 60,000 个开源项目和工具采纳,包括 Codex、Cursor、Gemini CLI 和 GitHub Copilot。
  • Shopify CEO Tobi Lütke 于 8 月下旬公开考虑在公司范围内禁用 Claude Code,除非它开始读取 AGENTS.md 和 .agents/skills 文件,并认为分层指令文件对 Shopify 的单体仓库至关重要。
  • Anthropic 宣布来自 Accenture 旗下 Faculty 部门的评估人员将以相当于正式员工的权限入驻公司,开展红队测试、对齐评估和安全审计,双方各自承诺在五年投入至少 10 亿美元。
  • 该评估安排明确为非独占且没有启动日期,Anthropic 计划公布更多评估机构,并正在与 METR 等非营利评估机构洽谈,而评估结果如何升级或发布等细节仍未披露。
Anthropic Claude Code 2.1.277 采纳 OpenAI 主导的 AGENTS.md 标准

Claude Code 终于支持 AGENTS.md

Anthropic 于 9 月 18 日(美国时间)发布了其编程代理 Claude Code——OpenAI 的竞争对手——的 2.1.277 版本,项目变更日志将 AGENTS.md 支持列为首要条目。当仓库中没有 CLAUDE.md——即该工具此前一直坚持使用的专有指令格式——时,Claude Code 将改为读取厂商中立的 AGENTS.md。同时维护这两个文件的团队可以通过 /config 中的“Project instructions”面板切换为并行加载。该功能尚未通过 Amazon Bedrock、Google Vertex AI 或 Microsoft Foundry 提供——这些平台上的企业用户将密切关注这一缺口。

AGENTS.md 是一种为 AI 编程代理编写的标准化指令文件:包含构建命令、测试流程和代码规范,代理在操作仓库之前会先读取这些内容。OpenAI 于 2025 年 8 月推出该格式,并于同年 12 月将其捐赠给 Linux 基金会旗下的 Agentic AI Foundation(AAIF)。根据该基金会自己的记录,此后已有超过 60,000 个开源项目和代理框架采纳了该格式,Codex、Cursor、Gemini CLI 和 GitHub Copilot 均已支持。对于同时运行多个此类工具的团队而言,Anthropic 这一变更的实际意义在于,一份指令文件现在可以管理来自不同厂商的代理,而不再需要每个工具各自维护一份副本。

Anthropic 也在同一天将其自有的 MCP 协议放入同一个基金会,并且是该基金会的铂金成员——这使得该基金会同时成为领先的代理指令格式与 Anthropic 自有 MCP 协议的共同归属,是竞争实验室之间罕见的一致立场。尽管如此,其旗舰编程工具在此后长达九个月的时间里仍只读取 CLAUDE.md,尽管早在 2025 年 8 月就已有人提交了公开的 GitHub 请求

压力最终公开化。8 月下旬,Shopify CEO Tobi Lütke 表示,除非 Claude Code 开始读取 AGENTS.md 和 .agents/skills 文件,否则他正在考虑在全公司范围内禁用该工具。他的理由是:Shopify 数千名开发者在一个单体仓库中工作,指令文件沿目录树逐层生效,任何缺少该文件的目录都会让部分团队“只剩半个大脑”地工作。Shopify 此前一直在用自动化手段弥补这一缺口——Lütke 称之为一种本可避免的“复杂性税”。

Claude Code 工程师 Thariq Shihipar 后来解释了最初的立场:不同模型家族不可互换,系统提示词对性能的影响足以让 Anthropic 坚持为不同模型定制提示词。新功能以内置“mod”的形式随一个即将推出的自定义机制一同交付,Anthropic 已在 GitHub 上公开了该机制的源代码,以及 diff、遥测和 sec-default 等 mod。相关机制的推出时间表,是希望超越文档默认配置的团队需要关注的。文档记录的配置涵盖四种模式:仅使用 CLAUDE.md;以 AGENTS.md 作为回退(新的默认模式);两个文件同时使用;以及仅使用企业下发的指令。在默认模式下,从仓库根目录到工作目录之间的任何 CLAUDE.md 都会抑制 AGENTS.md 的加载。在组合模式下,已经通过 CLAUDE.md 导入的 AGENTS.md 会被跳过,以避免重复加载。

Accenture 评估人员获得正式员工级权限

同一天,Anthropic 宣布了另一项可以说规模更大的举措:来自 Accenture 旗下专业 AI 部门 Faculty 的外部评估人员将入驻公司,拥有相当于正式员工的权限,独立评估前沿模型。根据 Anthropic 的官方公告,双方各自预计在五年内投入至少 10 亿美元来建设这一能力——合计下限为 20 亿美元。

其职责范围异常广泛:开展评估和红队测试、进行对齐评估、探测模型安全防护措施、在训练期间观察模型、跟踪模型开发与部署决策、直接与员工沟通、对照安全承诺审计公司运营、指出盲点并报告事件。

该公告明确与 CEO Dario Amodei 的文章《We Must Pace the Frontier》相呼应,那篇文章主张将评估人员置于 Anthropic 内部。曾经的书面承诺如今有了执行伙伴和资金数字——这是 Anthropic 与 OpenAI 此前放缓承诺中的首个量化行动,当时两家实验室均表示宁愿接受一场更慢的竞赛,也不愿接受一场没有边界的竞赛。

针对“外包评估即外包责任”这一显而易见的质疑,Anthropic 以一段值得原样引用的声明予以回应:“独立驻场评估人员不会削弱我们的问责性,反而使其更可验证。我们模型的安全性仍然是我们的责任。”

若干关键细节仍未披露。公告没有给出启动日期,且该安排明确为非独占:Anthropic 表示将在未来几周内公布更多评估机构,并正在与 METR 等非营利评估机构进行洽谈。评估结果如何升级、报告是否发布,以及“验证安全承诺”在实践中如何运作,这些问题均无答案。值得注意的是,公告本身没有引用任何高管的发言。

从外部压力到制度设计

综合来看,这两项举措描绘了一家将外部压力转化为制度设计的公司。变更日志将 AGENTS.md 支持置于 2.1.277 版本发布之首,弥合了 Anthropic 捐赠承诺与其自身工具合规之间长达九个月的落差;而 Accenture 驻场安排则将同样的开放精神从文件格式延伸到模型监督。在 COINOTAG 看来,其逻辑正是加密行业自身的逻辑:验证胜过信任。这些标准呼应了加密行业赖以建立的分层、规则优先的治理模式——从模块化的 Layer-3 区块链堆栈到由理事会治理的 Hedera (HBAR) 模式——而随着 AI 代理经济走向链上轨道,这些标准对快速增长的 AI 代理山寨币板块的重要性,将不亚于对开发者的重要性。近期的观察指标非常具体:AGENTS.md 支持是否会以及何时登陆企业云平台、Anthropic 还会点名哪些评估机构,以及评估结果是否最终会对外发布。