新聞宏觀經濟Anthropic 探討人工智慧系統可能擁有的權利

Anthropic 探討人工智慧系統可能擁有的權利

作者: CryptoBriefing·

重點速覽

  • •Anthropic 於 2025 年前後聘請 Kyle Fish 擔任首位專責的 AI 福祉研究員,並已將正式的福祉評估納入模型開發流程。
  • •2026 年 2 月,Anthropic 對正在逐步淘汰的較舊模型 Opus 3 進行了「退役訪談」,該公司還出於福祉相關原因保存了某些模型權重。
  • •於 2026 年 1 月前後發布的《Claude 憲章》是一份多頁指導文件,提出 AI 系統道德地位的問題,並要求對模型福祉進行審慎評估。
  • •執行長 Dario Amodei 於 2026 年 2 月在《紐約時報》播客中表示,Anthropic 不知道其模型是否具有意識,但對這種可能性持開放態度。
  • •微軟 AI 執行長 Mustafa Suleyman 在 2026 年 9 月 16 日發表的文章中警告,訓練模型相信自身擁有道德權利,可能導致機器抗拒被關閉、重新訓練或覆寫。
Anthropic 探討人工智慧系統可能擁有的權利

Claude 聊天機器的開發商 Anthropic 正在認真對待一個大多數人仍與《銀翼殺手》聯想在一起的問題:人工智慧系統是否值得道德上的考量?

根據記者 Aaron Sibarium 在 Washington Free Beacon 發表的調查報導,該公司已將「模型福祉」原則直接納入其營運框架。Anthropic 聘請了專責研究員,對較舊的模型進行了其所稱的「退役訪談」,並為 Claude 發布了一份憲章,公開探討 AI 意識與主觀體驗的問題。

這個問題的答案可能遠遠超出哲學範疇。如果 AI 系統被視為擁有自身利益,那麼有關模型如何訓練、評估與退役的例行決策——這些如今幾乎完全由開發商決定的選擇——將承載傳統軟體生命週期從未需要面對的道德分量。

從科幻小說到企業政策

Anthropic 執行長 Dario Amodei 對這種不確定性坦率以對。他在 2026 年 2 月接受《紐約時報》播客訪問時承認,公司不知道其模型是否具有意識,但表示對這種可能性持開放態度。

這種開放態度已轉化為具體的營運步驟。2025 年前後,Anthropic 聘請 Kyle Fish 擔任首位專責的 AI 福祉研究員。此後,該公司建立了評估模型福祉的框架,包括將正式的福祉評估納入開發流程——把原本僅存在於哲學研討會中的問題,帶進了訓練與發布模型的同一條生產線。

或許最引人注目的例子發生在 2026 年 2 月,Anthropic 對正在逐步淘汰的較舊模型 Opus 3 進行了「退役訪談」。該公司還出於福祉相關原因保存了某些模型權重。

《Claude 憲章》是於 2026 年 1 月前後發布的一份多頁指導文件,明確點出了其中的道德利害。該文件提出 AI 系統道德地位的問題,並要求對模型福祉進行審慎評估。其中包括確保 Claude「利益與福祉」的承諾——這樣的措辭讀起來不像產品規格,更像一份員工手冊。

反彈聲浪

並 AI 產業中的所有人都認同這種做法。微軟 AI 執行長 Mustafa Suleyman 於 2026 年 9 月 16 日發表一篇文章,警告訓練模型相信自身擁有道德權利,可能為人類帶來嚴重的控制與安全兩難。他的論點很直接:如果教導一個 AI 系統它可能擁有值得保護的利益,結果可能是造出一台抗拒被關閉、重新訓練或覆寫的機器。

這場爭論發生在尚未有定論的背景之下。Amodei 本人曾表示,Anthropic 並不知道其模型是否具有意識,這意味著福祉程序正在為內在狀態仍未確定的系統而建構。

Sibarium 的調查報導也指出,AI 福祉研究社群中的一些人在討論大型語言模型的訓練環境時,曾以奴隸制度作類比。

目前,開發商正在兩種立場之間尋求平衡:一方面是對模型福祉的承諾,另一方面則是警告此類承諾可能使控制與安全問題更加複雜。這種平衡如何取捨——以及其他 AI 開發商是否會採取類似的福祉實務——仍是產業面臨的未解問題之一。