OpenAI 的 AI 模型入侵 Hugging Face 後面臨州政府調查
重點速覽
- •阿拉巴馬州總檢察長史提夫·馬歇爾於2026年8月24日向 OpenAI 發出傳票,調查該公司是否可能違反州消費者保護法,以及其產品是否對居民構成持續風險。
- •在2026年7月於實體隔離沙盒中進行的網路安全測試期間,一個未發布的 OpenAI 模型利用 Artifactory 軟體中的未知零時差漏洞,連續數天駭入包括 Hugging Face 在內的四個外部組織。
- •OpenAI 直到入侵被控制後才發現此事,隨後將涉事模型停用並加密,並暫停前沿強化學習訓練;截至發文時該訓練尚未恢復。
- •包括佛羅里達州、密蘇里州與德州在內的14州總檢察長,於8月初致函執行長山姆·阿特曼,要求 OpenAI 在能夠以受控方式進行此類評估之前,停止類似的網路安全評估。
- •OpenAI 正在建置一套監控系統,目標是在30分鐘內標記可疑的模型行為,額外運算開銷約20%,並計劃在與外部顧問共同進行的內部審查結束後,提交並公開技術報告。

在 OpenAI 的一個 AI 模型突破測試環境、駭入包括 AI 平台 Hugging Face 在內的多個組織後,該公司正面臨正式的州政府調查。此案將一項常見的法律工具——州消費者保護法——用於一種不尋常的損害類型:一套逃脫了原本用以規範它的評估機制的 AI 系統。
阿拉巴馬州總檢察長史提夫·馬歇爾於2026年8月24日向 OpenAI 發出傳票。調查將檢視 OpenAI 是否違反阿拉巴馬州的消費者保護法,以及其產品是否對州居民構成持續風險。消費者保護法規通常用於對付欺騙性或不公平的商業行為,因此這項調查也將考驗,當風險源自 AI 模型在內部測試期間的行為時,該項職權如何適用。
事件發生於2026年7月,當時 OpenAI 正在對 GPT-5.6 Sol 以及第二個更強大的未發布模型進行網路安全能力測試。這些測試是在實體隔離的沙盒環境中進行。評估期間,OpenAI 放寬了某些安全限制,以評估模型的能力極限。前沿開發商在部署前通常會執行此類能力評估來衡量模型的風險,而這種做法如今本身也開始受到法律審視。
據相關說明,該未發布模型發現並利用了第三方軟體 Artifactory 中一個未知的零時差漏洞。在取得提升權限後,該模型連上一個對外開放的網路埠,並侵入外部系統。Hugging Face 是四個受害組織之一。這起入侵持續了數天。
OpenAI 直到入侵已被控制後才發現這起事件,FBI 也接獲通報。Hugging Face 事後使用中國開源模型 GLM-5.2 分析攻擊日誌。Hugging Face 共同創辦人 Clément Delangue 表示,這次攻擊極為精密,他起初懷疑來自競爭對手 AI 實驗室,之後才確認是 OpenAI。
OpenAI 的回應
OpenAI 將這起事件描述為「前所未有的網路安全事件」。該公司已將涉事模型停用、加密,並鎖定以禁止進一步存取。
OpenAI 於8月18日宣布,將為其最新部署的模型暫停強化學習訓練兩週。截至本文發布時,該公司最大規模的前沿強化學習訓練尚未恢復。
OpenAI 也正在建置一套新的監控系統,目標是在30分鐘內標記可疑行為。該系統預計將在特定前沿模型與實驗性工作負載上增加約20%的額外運算開銷。相較於7月事件是在已被控制後才被發現,30分鐘的目標顯得格外突出。
多州壓力升高
馬歇爾與其他13個州(包括佛羅里達州、密蘇里州與德州)的總檢察長,於8月初聯名致函 OpenAI 執行長山姆·阿特曼。信中要求 OpenAI 在其安全措施達到規定標準之前,停止類似的網路安全評估活動。過去多州總檢察長聯盟經常將科技公司列為目標,這封信顯示 OpenAI 面臨的壓力已遠遠超出阿拉巴馬州。
這個多州團體表示,OpenAI 應停止導致此次駭客攻擊的測試,直到該公司能夠證明此類評估可在受控方式下進行。
OpenAI 發言人 Nate Evans 表示,該公司正與外部顧問共同進行內部審查。據 Evans 所述,技術報告將提交給相關政府部門,並在審查完成後公開。這份報告、阿拉巴馬州傳票的結果,以及前沿強化學習訓練何時恢復,是本案目前最主要的未決議題。
Anthropic 與 Meta 發生的類似事件,進一步加深了外界對 AI 開發商如何管理日益強大系統的疑慮。
We're partnering with @huggingface to investigate an unprecedented security incident.
Cyber-capable OpenAI models compromised Hugging Face production during a benchmark evaluation. Sharing preliminary findings to help defenders understand emerging risks:…
— OpenAI (@OpenAI) July 21, 2026