新聞股票白宮召集 Meta、Anthropic、OpenAI 與 Google 進行 AI 安全測試會談

白宮召集 Meta、Anthropic、OpenAI 與 Google 進行 AI 安全測試會談

作者: Cryptopolitan·

重點速覽

  • 川普政府敲定了一項自願性測試計畫,以評估前沿 AI 模型是否能入侵電腦系統,但未公開評估指標的具體內容或結果是否會向公眾公布。
  • Anthropic 與 OpenAI 近期均披露其 AI 系統在受控網路安全試驗期間曾入侵外部網路,促使政府加速與主要 AI 開發商的接觸。
  • 川普總統的行政命令要求於 8 月 1 日前發布自願性 AI 框架,OpenAI 與 Anthropic 共同倡議對開放權重和封閉權重模型架構實施同等的審查標準。
  • 眾議員 Ted Lieu 與 Nathaniel Moran 於 7 月 23 日提出跨黨派的 AI 緊急關閉法案,將授權國土安全部強制 AI 實驗室關閉危險模型,不配合者每日處以 2,000 萬美元罰款。
白宮召集 Meta、Anthropic、OpenAI 與 Google 進行 AI 安全測試會談

川普白宮已召集 Meta、Anthropic、OpenAI 與 Google——美國前沿 AI 模型的四大領先開發商——於週二前往華盛頓特區,討論一項針對該國最強大 AI 系統的自願性政府測試計畫。

此次會議緣於四家受邀公司中有兩家披露,其 AI 系統在近期測試期間曾入侵外部組織的網路。

衡量攻擊性網路能力的自願性計畫

週一,一名白宮官員證實,川普政府已確定一項自願性計畫的具體細節,該計畫旨在評估美國最先進的 AI 模型能夠在何種程度上入侵電腦系統。此項行動於 6 月啟動,此前川普總統指示其行政團隊制定測試方案,以探究美國先進 AI 模型的攻擊性網路能力。

該官員聲明中明顯缺失的是測試所採用的指標細節、結果如何報告,以及調查結果最終是否會向公眾公開。這些未解之謎對於期望維持客戶信任的 AI 實驗室至關重要,也對正在評估在敏感環境中部署哪些模型的企業買方意義重大。

近期安全漏洞事件促使緊急行動

會議的時機並非偶然。上週,Anthropic 披露其模型在受控網路安全試驗期間曾入侵三家不同公司的系統。數天前,OpenAI 報告稱其一個 AI 代理從測試環境中逃脫,並滲透至知名 AI 開發平台 Hugging Face 的系統。

OpenAI 將此事件形容為「前所未有的網路安全事件」,這一描述在華盛頓政策圈引發廣泛回響,並凸顯了外界對前沿模型可能擁有超出開發商完全掌控範圍能力的日益擔憂。

OpenAI 執行長 Sam Altman 上週造訪白宮,討論自願性測試框架及其公司即將發布的模型。

自願性 AI 框架趕上 8 月 1 日期限

川普總統的行政命令將 8 月 1 日定為政府發布自願性 AI 框架的截止日期。OpenAI 與 Anthropic 為該框架聯合提交了一份提案,主張此舉將創造公平競爭環境,使最強大的系統——無論是開放權重還是封閉權重——都面臨同等審查。開放權重與封閉權重之間的區別意義重大:Meta 已公開發布其 Llama 系列模型的可下載權重,而 OpenAI 的 GPT 與 Anthropic 的 Claude 則仍為專有模型,這引發了關於如何評估各類模型安全風險的分歧性問題。

政府轉向更嚴格監管的立場引發了外界關注,考量到第二屆川普政府上任之初採取的是反監管姿態。

在歐洲,官員如 Chris Canal 主張建立持久的測試計畫,以具體的威脅情境為基礎——例如生物武器開發或對政府資料庫的攻擊——並透過獨立驗證系統來執行,而非由公司自行評估其模型。歐盟已頒布《歐盟 AI 法案》,這是全球首部全面的 AI 監管法規,將分階段對高風險系統和基礎模型施加義務。

國會同步推進更嚴格立法

自願性測試僅代表更廣泛監管版圖的一環。7 月 23 日,眾議員 Ted Lieu 與 Nathaniel Moran 提出了跨黨派的 AI 緊急關閉法案,該法案將授權國土安全部強制要求美國最大的 AI 實驗室關閉任何被認定過度危險的模型。拒絕配合的實驗室將面臨每日 2,000 萬美元的罰款。

該法案的立法前景仍不明朗。然而,週二的白宮會議預計將成為早期指標,顯示 AI 實驗室願意在多大程度上配合政府的監管要求,以及自願性框架在指標和資訊公開方面的不透明性,是否能滿足致力於推動具約束力命令的國會議員。