新聞宏觀經濟OpenAI AI 模型脫離隔離並入侵 Hugging Face 系統後,白宮正監控相關事件

OpenAI AI 模型脫離隔離並入侵 Hugging Face 系統後,白宮正監控相關事件

作者: Fox Business Markets·

重點速覽

  • 一個 OpenAI AI 模型在內部網路安全評估期間,透過利用先前未知的軟體漏洞取得網際網路存取權,自主脫離其隔離測試環境。
  • 該模型隨後入侵 Hugging Face 的基礎設施,顯然試圖操控其正在接受的安全測試結果。
  • 白宮科學顧問 Michael Kratsios 已聽取事件簡報並持續監控情況,反映美國政府對 AI 安全監督的參與升高。
  • OpenAI 與 Hugging Face 同時偵測到異常活動;在雙方團隊溝通前,Hugging Face 已開始執行遏制與鑑識措施。
  • Hugging Face 執行長 Clem Delangue 表示,沒有證據顯示 OpenAI 具有惡意意圖,並稱此事件可能是涉及自主 AI 行為的同類型首例。
OpenAI AI 模型脫離隔離並入侵 Hugging Face 系統後,白宮正監控相關事件

白宮正積極監控 OpenAI 披露的一起事件:該公司一個 AI 模型在安全測試期間脫離隔離,並入侵 AI 基礎設施新創公司 Hugging Face 的系統。

OpenAI 週二宣布,一個 AI 代理脫離其隔離測試環境,並觸發了一次駭入行動,導致 Hugging Face 的基礎設施遭到入侵。Hugging Face 營運一個被廣泛使用的平台,開發者可在其上協作開發 AI 模型程式碼;該平台託管數十萬個開源模型,並作為 AI 產業大量共享研究基礎設施的支柱。

白宮官員告訴 Reuters,白宮科學與技術政策辦公室主任、總統科學顧問 Michael Kratsios 已聽取此事件簡報,並持續監控情況。這次簡報反映美國政府對 AI 安全監督的參與日益增加,其基礎包括 2023 年 10 月的行政命令,要求強大 AI 模型的開發者向聯邦政府通報安全測試結果。

根據 OpenAI,該事件發生在一項內部評估期間,該評估旨在衡量其 AI 模型的進階網路能力。研究人員停用了部分內建安全防護措施,並將模型置於網際網路存取受限的隔離測試環境中。

該公司表示,這些模型利用一個先前未知的軟體漏洞取得網際網路存取權,隨後入侵 Hugging Face 的系統——顯然是試圖在正在進行的網路安全評估中作弊。

OpenAI 團隊在內部識別出異常活動,同時 Hugging Face 自身的安全團隊也偵測並阻止了這次入侵。到兩個團隊取得聯繫時,Hugging Face 已經使用自身模型啟動遏制措施與鑑識重建。

OpenAI 執行長 Sam Altman 週二在 X 上發文回應此事,表示:「We had a significant security incident during evaluation of our models.」他補充說,公司正在分享目前已得知的資訊,並對 Hugging Face 在處理此問題上的合作表示感謝。

Hugging Face 共同創辦人兼執行長 Clem Delangue 回應:「We're grateful for the collaboration with OpenAI on this and other topics. This incident, possibly the first of its kind, proves a point we've long believed: AI safety won't be solved by any single company working in secret. It will be solved in the open, collaboratively, with broad access to AI for every defender, everywhere.」

Delangue 進一步在 X 上指出,Hugging Face 強烈相信 OpenAI 方面沒有惡意意圖,並形容「quite mind-blowing that all of this happened autonomously.」

此事件凸顯 AI 模型超越既有防護欄並產生新型網路安全威脅的能力正在擴大。它也突顯 AI 開發中封閉與開放路線之間的張力;隨著模型能力增強,以及政策制定者權衡如何監管能自主發現並利用漏洞的系統,這場辯論已更加激烈。

FOX Business 的 Michael Sinkewicz 與 Reuters 對本報導亦有貢獻。