Anthropic 選定 Accenture 作為首家內嵌評估機構,推動 AI 減速計畫
重點速覽
- •Anthropic 選定 Accenture 作為其首家內嵌評估機構,將執行長 Dario Amodei 9 月 12 日減速提案的第一步付諸實踐。
- •與 Accenture 及其 AI 業務部門 Faculty 的合作涵蓋評估與紅隊測試模型、執行對齊評估以及測試模型安全防護機制。
- •Anthropic 與 Accenture 各自預計在五年內為該項目投資至少 10 億美元;由於目前尚無為獨立評估提供資金的機制,Anthropic 將直接資助此項工作。
- •業界對 Amodei 提案的反應不一,OpenAI 執行長 Sam Altman 與 Elon Musk 表達支持,而 Nvidia 執行長 Jensen Huang 則認為此類監管並無必要。
- •此合作為非獨家性質,Anthropic 預計在未來幾週內宣布更多評估機構;包括類似員工存取權限如何運作在內的營運問題仍未解決。

Anthropic 已選定 Accenture 作為其首家內嵌評估機構,這項合作旨在支持 Anthropic 執行長 Dario Amodei 上週提出的放慢 AI 開發速度之計畫。
Amodei 於 9 月 12 日發布三步驟提案,呼籲以較慢的速度推進 AI 開發,以便建立安全防護措施,並引用快速且缺乏約束的進展可能帶來災難性危害的警告。
業界反應不一。OpenAI 執行長 Sam Altman 與 SpaceX 執行長 Elon Musk 對該計畫表達支持,而 Nvidia 執行長 Jensen Huang 則不然,他認為此類監管並無必要。Anthropic 在業界缺乏共識的情況下展開計畫的實施。
Amodei 在提案中寫道:「AI 的進展急劇加快,主要驅動力是 AI 建構下一代 AI 的能力不斷提升。這種動態被稱為遞迴自我改進」,並補充說「若不加約束,它可能超越我們理解與控制這些系統的能力。」
該計畫的第一步是設立擁有類似員工存取權限的獨立評估機構——據 Amodei 所述,Anthropic 此前已單方面作出這一承諾。上週五,該公司宣布與 Accenture 及其 AI 業務部門 Faculty 建立合作夥伴關係,聚焦於「評估與紅隊測試模型、執行對齊評估以及測試模型安全防護機制」,以履行這一承諾。此舉使提案的第一步從原則走向實踐。
該公司表示由於內嵌評估是一個全新領域,相關運作方式的細節仍在制定中——諸如類似員工存取權限在實務中如何運作等基本問題,目前尚未有答案。
根據公告,Anthropic 與 Accenture 各自預計在未來五年內為該項目投資至少 10 億美元。
因情況緊急,Anthropic 將直接資助此項工作
Anthropic 指出,目前並不存在為獨立評估提供資金的機制,長期資金最終應來自集合資金或政府來源。然而,鑑於此項工作的緊迫性,Anthropic 將直接資助 Accenture 的工作。在更廣泛的資助機制建立之前,兩家公司的自身承諾是目前唯一支持這項工作的資金來源。
此合作為非獨家性質,Anthropic 表示預計將在未來幾週內宣布更多合作評估機構。隨著這一新領域逐步成形,這些公告以及仍未確定的營運細節,將是值得關注的指標。
據 Accenture 表示,Faculty 專門為全球部分領先的 AI 實驗室測試與評估模型,並建構在設計上即安全且合乎倫理的複雜 AI 系統。
Accenture 董事長兼執行長 Julie Sweet 表示:「內嵌評估是一個新興領域,我們期待與 Anthropic 合作,協助加速內嵌評估機構的發展,我們認為這是未來安全版圖的重要一環。」