Anthropic 与 Accenture 深化人工智能合作,承诺投入十亿美元
要点速览
- •Anthropic 与 Accenture 预计将通过新的嵌入式评估计划,在未来五年内各投入至少 10 亿美元用于人工智能安全。
- •该计划将由 Accenture 旗下的专业人工智能业务 Faculty 主导,其评估人员将获得与 Anthropic 员工相当的访问权限,以观察训练过程、对模型进行红队测试检验安全防护措施。
- •这一举措源于 Anthropic 首席执行官 Dario Amodei 的文章《我们必须为前沿踩下节奏》("We Must Pace the Frontier"),他呼吁独立评估人员进入前沿人工智能实验室开展工作。
- •Faculty 具备此前的前沿模型测试经验,包括参与 Anthropic 的 Claude 4 模型的生物安全评估以及对 OpenAI 的 o1 进行红队测试。
- •该安排并非排他性,Anthropic 正与非营利评估机构 METR 洽谈,并计划在未来几周内宣布更多合作伙伴。

Anthropic 与 Accenture 正通过一项面向前沿人工智能的新型嵌入式评估计划扩大双方在人工智能安全方面的合作,两家公司预计未来五年在该领域各投入至少 10 亿美元。该举措旨在填补行业尚未解决的空白:让前沿实验室的安全承诺能够被独立验证。
该计划将由 Accenture 旗下的专业人工智能业务 Faculty 主导,Accenture 今年早些时候宣布了收购这家英国人工智能公司的计划,作为其人工智能能力更广泛扩展的一部分。Faculty 的评估人员将与 Anthropic 团队并肩工作,对模型进行评估和红队测试,开展对齐评估,并测试模型的安全防护措施。
与传统的外部评估人员不同,这些嵌入式团队预计将获得与 Anthropic 员工相当的访问权限。这将使他们能够在训练期间观察模型,审查有关开发和部署的决策,并评估公司是否履行其安全承诺。这种访问深度正是该模式的独特之处——将评估引入开发过程内部,而不是将其留在实验室的边界之外。
这一举措源于 Anthropic 首席执行官 Dario Amodei 在其近期文章《我们必须为前沿踩下节奏》("We Must Pace the Frontier")中作出的承诺,他呼吁独立评估人员进入前沿人工智能实验室开展工作,作为使安全承诺可验证的更广泛努力的一部分。新计划将这一提议转化为实际安排,背后有明确的合作伙伴和明确的资金承诺。
Faculty 此前曾与主要人工智能开发者合作开展安全测试,包括参与 Anthropic 的 Claude 4 模型的生物安全评估,以及对 OpenAI 的 o1 进行红队测试。这一履历意味着该团队在测试来自不止一家实验室的前沿模型方面拥有实战经验。
Anthropic 表示,该框架仍处于实验阶段,因为目前尚无成熟的行业标准来确定嵌入式评估人员可以访问哪些内容,或应如何报告其评估结果。在缺乏既定规范的情况下,该计划自身在访问权限和信息披露方面的实践将界定其条款。资金问题也尚未解决。Anthropic 此前曾主张,独立评估最终应通过联合资金池或政府支持的机制来资助,但就与 Accenture 的合作而言,Anthropic 将直接为评估工作出资,这意味着该模式目前依赖于企业直接出资,而非 Anthropic 所倡导的共享基础设施。
这一安排并非排他性。Anthropic 表示,公司还在与非营利评估机构 METR 洽谈,并计划在未来几周内宣布更多评估合作伙伴,同时 Accenture 仍可自由地与其他人工智能开发者合作。这一结构表明,Anthropic 倾向于组建一个嵌入式评估人员阵容,而非依赖单一合作关系。
Anthropic 强调,嵌入式评估人员并不会将模型安全的责任转移给外部机构。相反,该计划旨在让公司自身的安全承诺更容易得到独立验证。未来几周至少应明确两件事:哪些额外评估人员将加入该计划,以及其实验性的访问与报告条款将如何成型。