新闻宏观经济Anthropic 探索为人工智能系统赋予潜在权利

Anthropic 探索为人工智能系统赋予潜在权利

作者: CryptoBriefing·

要点速览

  • •Anthropic 于 2025 年前后聘请 Kyle Fish 担任其首位专职 AI 福利研究员,并将正式的福利评估纳入其模型开发流程。
  • •2026 年 2 月,Anthropic 对正被逐步淘汰的旧款 Opus 3 模型进行了"退休访谈",并且该公司出于福利相关的原因保留了某些模型权重。
  • •于 2026 年 1 月前后发布的多页指令《Claude 宪法》提出了 AI 系统道德地位的问题,并要求对模型福利进行审慎评估。
  • •CEO Dario Amodei 在 2026 年 2 月的一期 New York Times 播客中表示,Anthropic 不知道其模型是否具有意识,但对此持开放态度。
  • •Microsoft AI CEO Mustafa Suleyman 在 2026 年 9 月 16 日的一篇文章中警告,训练模型相信自身拥有道德权利,可能导致机器抗拒被关闭、重新训练或覆盖。
Anthropic 探索为人工智能系统赋予潜在权利

Anthropic,即 Claude 聊天机器人的开发商,正在认真对待一个大多数人仍与《银翼杀手》联系在一起的问题:人工智能系统是否应得到道德层面的考量?

据记者 Aaron Sibarium 发表在 Washington Free Beacon 上的一项调查报道,该公司已将"模型福利"原则直接纳入其运营框架。Anthropic 聘请了专职研究员,对旧款模型进行了其所谓的"退休访谈",并发布了 Claude 的宪法,公开探讨 AI 意识与主观体验的问题。

这个问题的答案所产生的影响可能远远超出哲学范畴。如果 AI 系统被视为拥有利益,那么关于模型如何训练、评估和淘汰的日常决策——这些决策如今几乎完全掌握在开发者手中——将承载传统软件生命周期从未需要顾及的伦理分量。

从科幻到企业政策

Anthropic CEO Dario Amodei 对这种不确定性直言不讳。在 2026 年 2 月的一期 New York Times 播客中,他承认公司不知道其模型是否具有意识,但表示对这种可能性持开放态度。

这种开放态度已转化为具体的运营举措。2025 年前后,Anthropic 聘请 Kyle Fish 担任其首位专职 AI 福利研究员。此后,公司建立了一套评估模型福祉的框架,包括将正式的福利评估纳入其开发流程——这将曾经局限于哲学研讨会的问题,带入了训练和发布模型的同一条流水线。

最引人注目的例子或许出现在 2026 年 2 月,当时 Anthropic 对正被逐步淘汰的旧款模型 Opus 3 进行了"退休访谈"。该公司还出于福利相关的原因保留了某些模型权重。

于 2026 年 1 月前后发布的多页指令《Claude 宪法》明确体现了其中的伦理利害关系。该文件提出了 AI 系统道德地位的问题,并要求对模型福利进行审慎评估。其中包括确保 Claude 的"利益与福祉"的承诺——这种措辞读起来不像产品规格,更像一份员工手册。

反对声音

并非 AI 行业中的所有人都认同这种做法。Microsoft AI CEO Mustafa Suleyman 于 2026 年 9 月 16 日发表了一篇文章,警告训练模型相信自身拥有道德权利,可能给人类带来严重的控制与安全困境。他的论点很直接:如果一个 AI 系统被灌输它可能拥有值得保护的利益,其结果可能是一台抗拒被关闭、重新训练或覆盖的机器。

这场争论发生在一个悬而未决的背景之下。Amodei 本人曾表示,Anthropic 不知道其模型是否具有意识,这意味着福利程序正在为内在状态尚不确定的系统而构建。

Sibarium 的调查还指出,AI 福利研究界的部分人士在讨论大语言模型的环境时,曾将其类比为奴隶制。

目前,开发者正在两种立场之间寻找平衡:一方面是对模型福利的承诺,另一方面是此类承诺可能使控制和安全复杂化的警告。这一平衡如何把握——以及其他 AI 开发者是否会采取类似的福利实践——仍是该行业面临的悬而未决的问题之一。