Anthropic 與 Accenture 深化 AI 夥伴關係,投入十億美元安全承諾
重點速覽
- •Anthropic 與 Accenture 預計在未來五年內透過全新的內嵌評估計畫,各自在 AI 安全領域投入至少 10 億美元。
- •該計畫將由 Accenture 的專業 AI 業務部門 Faculty 主導,其評估人員將獲得與 Anthropic 員工相當的存取權限,可在訓練期間觀察模型、進行紅隊測試並測試防護機制。
- •此舉延續 Anthropic 執行長 Dario Amodei 的文章〈We Must Pace the Frontier〉,該文呼籲獨立評估機構進駐前沿 AI 實驗室。
- •Faculty 具備前沿模型測試經驗,包括參與 Anthropic Claude 4 模型的生物安全評估,以及對 OpenAI 的 o1 進行紅隊測試。
- •此安排並非獨家,Anthropic 正與非營利評估機構 METR 洽談,並計畫在未來幾週宣布更多合作夥伴。

Anthropic 與 Accenture 正透過一項全新的前沿 AI 內嵌評估計畫擴大雙方在人工智慧安全上的合作,雙方預計在未來五年內各投入至少 10 億美元。此舉旨在填補產業尚未彌補的缺口:讓前沿實驗室的安全承諾能夠被獨立驗證。
該計畫將由 Accenture 的專業 AI 業務部門 Faculty 主導。Accenture 今年稍早宣布計畫收購這家總部位於英國的 AI 公司,作為其擴展 AI 能力的一環。Faculty 的評估人員將與 Anthropic 團隊合作,評估並對模型進行紅隊測試、執行對齊評估,並測試模型防護機制。
與傳統的外部評估機構不同,這些內嵌團隊預計將獲得與 Anthropic 員工相當的存取權限。這將使他們能夠在訓練期間觀察模型、審視開發與部署相關決策,並評估公司是否履行其安全承諾。這種存取深度正是此模式的獨特之處,將評估工作帶入開發流程內部,而非停留在實驗室邊界。
此舉是 Anthropic 執行長 Dario Amodei 在其近期文章〈We Must Pace the Frontier〉中承諾的延續,他在文中呼籲獨立評估機構進駐前沿 AI 實驗室,作為讓安全承諾可被驗證的更廣泛努力的一部分。這項新計畫將該提案轉化為可運作的安排,背後有具名的合作夥伴與明確的資金承諾。
Faculty 此前曾與多家主要 AI 開發商合作進行安全測試,包括參與 Anthropic Claude 4 模型的生物安全評估,以及對 OpenAI 的 o1 進行紅隊測試。這一紀錄意味著該團隊測試來自多家實驗室的前沿模型方面具備實戰經驗。
Anthropic 表示,該框架仍處於實驗階段,目前尚無既定的產業標準來規範內嵌評估人員可存取的內容,或其發現應如何報告。在缺乏共識規範的情況下,該計畫自身在存取與揭露方面的做法將定義其運作條件。資金問題也尚未解決。Anthropic 此前主張,獨立評估最終應透過共同基金或政府支持的機制來融資,但在與 Accenture 的合作中,該公司將直接出資評估工作,這意味著此模式目前依賴的是直接的企业資金,而非 Anthropic 所倡議的共享基礎設施。
此安排並非獨家。Anthropic 表示,該公司也正與非營利評估機構 METR 洽談,並計畫在未來幾週宣布更多評估合作夥伴,而 Accenture 仍可與其他 AI 開發商合作。這一結構顯示 Anthropic 的目標是建立一組內嵌評估機構,而非依賴單一合作關係。
Anthropic 強調,內嵌評估人員並不會將模型安全的責任轉移給外部組織,而是旨在讓公司自身的安全承諾更容易被獨立驗證。未來幾週至少有兩件事值得關注:哪些額外的評估機構將加入該計畫,以及其實驗性的存取與報告條件將如何成形。