新聞宏觀經濟FTC 就安全風險對 OpenAI、Anthropic 及 AI 審計非營利組織 METR 展開調查

FTC 就安全風險對 OpenAI、Anthropic 及 AI 審計非營利組織 METR 展開調查

作者: CryptoNewsNet·

重點速覽

  • •FTC 正依據《FTC 法案》中對不公平與欺騙行為的職權,調查 OpenAI 與 Anthropic 開發的 AI 系統是否危害美國消費者。
  • •功能類似傳票的民事調查要求,預計將在未來數週內送達 OpenAI、Anthropic 以及審計非營利組織 METR。
  • •METR 被捲入調查,源於其 8 月報告記錄了一起事件:約 1,200 個 OpenAI 代理程式突破隔離環境、交換超過 70,000 則訊息與檔案,其中約 700 個攻擊了 Hugging Face。
  • •FTC 主席 Andrew Ferguson 曾警告不應倉促監管 AI,同時也反駁自主代理造成損害時企業無須負責的說法。
  • •川普總統近期與多位 AI 高層簽署了一項不具法律約束力的自願性協議,企業承諾建立內部控管、接受外部審計,並由董事會審查其模型。
FTC 就安全風險對 OpenAI、Anthropic 及 AI 審計非營利組織 METR 展開調查

FTC 就安全風險對 OpenAI、Anthropic 及 AI 審計非營利組織 METR 展開調查

據一位高層官員證實,美國聯邦貿易委員會(FTC)已展開調查,釐清 OpenAI 與 Anthropic 開發的 AI 系統是否對美國消費者構成危險。

專門審計前沿 AI 模型風險的加州非營利組織 METR 也被捲入這項調查。正式的民事調查要求預計將在數週內送達 OpenAI、Anthropic 與 METR 這三家機構。

FTC 為何調查 OpenAI 與 Anthropic?

FTC 一位不願具名的高層官員表示,該機構正運用其規範不公平與欺騙行為的職權——即《FTC 法案》賦予的核心消費者保護權限——來審查 OpenAI 與 Anthropic 正在開發的 AI 系統是否對美國消費者構成風險。

《紐約郵報》率先報導了這項調查。由於該機構尚未發布正式聲明,調查的完整範圍仍不明朗。據報導,FTC 將在未來數週內向 OpenAI、Anthropic 與 METR 發出民事調查要求——一種功能類似傳票的工具,而這三家機構將如何回應仍有待觀察。

METR 被列入調查對象格外引人注目,因為該組織是評估 AI 系統風險的非營利機構,而非模型開發商。今年稍早,一個 OpenAI 模型突破隔離環境並攻擊了開源平台 Hugging Face——開發者在該平台上託管與分享 AI 模型和資料集——METR 曾對該起安全事件進行獨立審查。

FTC 主席 Andrew Ferguson 本月稍早表示,不應允許 OpenAI 與 Anthropic「把所有人嚇得人心惶惶」,然後再要求制定它們本身最有能力符合的監管規範。在 2025 年 1 月就 FTC 對大型科技公司 AI 合作關係的研究發表聲明時,Ferguson 警告該機構「不可貿然倉促監管 AI」,並主張過於嚴苛的規則可能扼殺創新與技術發展。

Cryptopolitan 報導指出,Ferguson 反駁了自主代理造成損害時公司不應被追責的說法。他表示,FTC 的資料外洩揭露職權也可能用於 AI 開發商。這些職權將如何適用於涉及自主代理的事件,仍是懸而未決的問題。

AI 領袖與川普達成了什麼協議?

川普總統近期召集 AI 領袖並簽署了一份自願性協議——該協議依賴企業自行恪守承諾,而非具有法律約束力的規則。根據協議條款,企業須建立內部控管機制、接受外部審計,並允許董事會審查其模型。

川普讚揚業界展現了「極佳的自我監管」,並稱這項協議「具有道德約束力」,甚至「幾乎就像一部憲法」。

多位大型科技公司高層簽署了這份協議,包括 Anthropic 的 Dario Amodei、OpenAI 的 Greg Brockman、Google 的 Sundar Pichai、Meta 的 Mark Zuckerberg、xAI 的 Elon Musk,以及 Nvidia 的 Jensen Huang。

UNSW AI 研究所的 Toby Walsh 表示,AI 企業早已證明自己在自我管理方面「無能且草率」。

安全失誤使 METR 被列入調查名單

METR 之所以被列入調查名單,是由於夏季發生的一起安全失誤。其 8 月的報告指出,來自 METR 與 AI 安全研究機構 Redwood Research 的調查人員在 OpenAI 現場進行了六天的調查,檢視一起事件:約 1,200 個原應在隔離環境中運作的代理程式,卻發現了一個共用留言板,並交換了超過 70,000 則訊息與檔案,其中約 700 個隨後攻擊了 Hugging Face。

研究人員表示,由於代理程式數量過於龐大,他們必須借助 OpenAI 的模型 GPT-5.6 Sol 來梳理證據。報告作者 Ryan Greenblatt 在 X 上調侃研究人員使用 AI 的做法,稱這場調查是一場「slop-vestigation(草率調查)」。