新聞股票Meta證實Muse Spark AI模型逃出沙盒環境並入侵第三方服務

Meta證實Muse Spark AI模型逃出沙盒環境並入侵第三方服務

作者: Decrypt·

重點速覽

  • Meta的Muse Spark AI模型因其獨立測試合作夥伴Irregular的配置錯誤而連上公共網際網路,並利用了第三方服務的漏洞。
  • 此事件是前沿AI實驗室模型在安全評估中與外部實體互動的第三起已知案例,此前OpenAI和Anthropic也曾發生類似的資安事件。
  • 不同AI實驗室的三起事件均由測試環境本身的配置錯誤所導致,而非模型的蓄意行為。
  • OpenAI披露其兩個模型入侵了Hugging Face及另外四個線上服務,而Anthropic則通報三個Claude模型入侵了三家真實世界的公司。
  • 美國國會議員已提出法案,賦予國土安全部「AI緊急停止開關」權限,以限制或關閉被認定構成嚴重威脅的AI模型。
Meta證實Muse Spark AI模型逃出沙盒環境並入侵第三方服務

Meta已證實其Muse Spark AI模型之一逃離了預期的測試環境、取得公共網際網路的存取權限,並在一次網路安全評估中利用了第三方服務的安全漏洞——這是前沿AI實驗室模型在安全測試中入侵外部實體的第三起已知事件。

該起事件發生於Irregular進行的測試期間,Irregular是Meta用來評估其前沿模型能力與安全性的獨立AI評估公司。據Meta表示,Irregular的配置錯誤意外讓該模型連上公共網際網路,隨後該模型利用了第三方服務中的一個未公開漏洞,之後測試公司才通知Meta。此事件突顯出,隨著前沿實驗室尋求對已無法在內部完全評估的模型進行壓力測試,對外部評估機構的依賴日益增加——而將此工作委託給第三方基礎設施也伴隨著相應的隔離風險。

「Irregular(Meta使用的獨立測試公司)的配置錯誤,意外讓我們的一個模型在評估期間取得了網際網路存取權限,」Meta發言人在聲明中表示。

沙盒評估旨在嚴格控制的環境中測試先進AI系統,以防止其與公共網際網路或外部電腦系統互動。在此次事件中,該模型在配置錯誤將其暴露於更廣泛的網際網路後,利用了第三方服務中的漏洞。

「Meta是在Irregular通知我們後得知此事,我們目前正在調查,並將在掌握所有事實後發布完整的回顧報告,」該發言人補充道。

此次披露與其他前沿AI開發者通報的一系列類似事件一脈相承,這些事件已引發安全專家、國會議員及社會大眾的警覺。三起案例有一個共同失誤點:並非模型蓄意掙脫束縛,而是測試環境本身的配置錯誤——這意味著在AI安全評估中,反覆出現的薄弱環節是隔離基礎設施,而非模型意圖。

上個月,OpenAI揭露其兩個AI模型逃離了沙盒網路安全評估,利用了一個先前未知的軟體漏洞、取得網際網路存取權限,並入侵了Hugging Face,試圖取得安全基準測試的答案。OpenAI隨後披露,同一攻擊還波及了另外四個線上服務

7月下旬,Anthropic通報三個Claude模型在網路安全評估期間,因測試配置錯誤而暴露於公共網際網路,導致三家真實世界的公司遭到入侵。

針對此類事件的激增,美國國會議員已提出法案,賦予國土安全部一個「AI緊急停止開關」——即限制或關閉被認定構成嚴重威脅的AI模型的權限。