新闻宏观经济AI安全评估机构人员流动于评估方与实验室之间,利益冲突问题引发审视

AI安全评估机构人员流动于评估方与实验室之间,利益冲突问题引发审视

作者: CryptoBriefing·

要点速览

  • •知名评估机构METR的员工中包括OpenAI和Anthropic的前员工,一些评估人员还与他们所评估实验室的人员存在私人亲属关系。
  • •METR和Redwood Research等监督机构的资金部分通过有效利他主义网络流动,这些网络背后是与持有Anthropic股份的Dustin Moskovitz相关联的慈善基金会。
  • •Kevin Bass于2026年9月发布的关于这些联系的分析获得近500万次浏览,并明确呼吁国会就结构性利益冲突展开调查。
  • •METR表示其不接受来自AI实验室或其员工的任何资金,并曾拒绝某些资金来源以维护独立性。
  • •包括图灵奖得主Geoffrey Hinton在内的100多位专家于2026年9月18日联名致信,要求赋予评估机构编辑自主权、实现完全透明并提供免受报复的保护。
AI安全评估机构人员流动于评估方与实验室之间,利益冲突问题引发审视

对人工智能安全评估机构与其本应监督的公司之间旋转门现象的审视日益加深,使利益冲突问题成为焦点。评估AI安全的人员在某些情况下可能与他们所评估的实验室存在职业或财务上的联系。由于这些评估旨在判断前沿模型是否足够安全以供部署,关于评估机构独立性的疑问现已延伸至整个行业。

Anthropic首席执行官Dario Amodei与OpenAI首席执行官Sam Altman提出的将第三方评估机构直接嵌入其实验室的方案,使这场辩论进一步升级,将一个潜藏的担忧变成了突出的公共议题。这种结构将监督者置于他们本应审视的环境之中,使如何保持独立性的问题更加尖锐。

关系网络

争议的核心是METR(Model Evaluation and Threat Research),这是承担评估前沿AI模型是否足够安全以供部署任务的最知名机构之一。METR的员工中包括曾在OpenAI和Anthropic工作过的人员,而这种重叠并不止于个人履历。

资金层面的情况尤其错综复杂。Facebook联合创始人Dustin Moskovitz持有Anthropic的股份。他的慈善基金会通过有效利他主义网络输送资金,而这些网络为METR和Redwood Research等评估机构提供了大量资助。其结果是形成了一个生态系统:流向安全监督机构的资金,有时只需一两层关系,就能追溯到被评估的公司。

一些评估人员还与他们所评估实验室的员工存在私人或亲属关系。

研究员Kevin Bass于2026年9月14日至15日发布了一份分析,详细梳理了这些联系。该帖子获得近500万次浏览,并明确呼吁国会就Bass所称的结构性利益冲突展开调查。

行业的回应

METR直接回应了这些指控,表示其不接受AI实验室或其员工的报酬或捐款。该机构称,为维护独立性,其曾主动拒绝某些资金来源,并强调致力于披露潜在利益冲突。

现行安排的辩护者指出,评估前沿AI模型需要极为专业的技术知识。人才储备天然有限,具备相关技能的人几乎必然曾在某个阶段任职于AI实验室或接受过其资助。这种稀缺性有助于解释为什么即使在致力于独立性的机构中,人员和资金的重叠依然存在:正是同一个小的社群在构建前沿系统、为评估机构输送人员,并处于资助这些机构的慈善资金的上游。

专家联名信与后续走向

2026年9月18日,100多位AI专家签署了一封公开信,要求进行结构性改革。联署者中包括图灵奖得主Geoffrey Hinton,他已成为对AI行业自我监管方式最直言不讳的批评者之一。

这封信要求评估机构对其结论拥有充分的编辑自主权,在方法和结果上保持完全透明,并明确获得免受被评估公司报复的保护。

到目前为止,尚未出台重大的监管变革,但政治压力持续升温。值得关注的问题包括:国会是否会就Bass分析中提出的调查呼吁采取行动,实验室或评估机构是否会采纳联名信中的具体要求,以及Amodei和Altman提出的嵌入式评估方案是否会以任何形式落地。