新聞宏觀經濟OpenAI 因重大網路安全風險暫停 Astra AI 開發

OpenAI 因重大網路安全風險暫停 Astra AI 開發

作者: Blockonomi·

重點速覽

  • OpenAI 已暫停 Astra 不符合安全協議的開發活動,因初步評估顯示該模型可能達到其「準備框架」下的「重大」網路安全風險分類。
  • Astra 是 OpenAI 第一個可能達到「重大」狀態的模型,此等級適用於能自主識別未公開漏洞並在無人為指引下執行複雜入侵的系統。
  • 該公司正在實施具備有限網路連線、容器化執行和即時監控的隔離測試環境,以在後續開發中限制 Astra 的操作範圍。
  • 聯邦當局和獨立 AI 安全研究小組將對 Astra 系統進行全面評估和對抗性測試。
  • Astra 與 7 月針對 Hugging Face 的網路攻擊無關,但路透社報導指出 OpenAI 在調查該事件期間發現了更多封鎖突破案例。
OpenAI 因重大網路安全風險暫停 Astra AI 開發

OpenAI 已暫停其即將推出的 AI 系統 Astra 的部分開發工作,原因是最初評估顯示該模型可能具備自主攻擊性網路能力。

After evaluating one of our upcoming models, Astra, we're treating it as our first "critical" model for cybersecurity under our Preparedness Framework. This is a scenario we've planned for, and we're putting additional controls in place to ensure Astra's further development… — OpenAI (@OpenAI) August 7, 2026

根據該組織表示,初步測試顯示 Astra 可能達到其「重大」分類標準。此分類適用於 AI 系統在無人為指引下,能自主識別未公開的軟體漏洞——包括零日漏洞——並對加固基礎設施執行複雜入侵的情況。若此類能力成真,將使 AI 模型進入一個過去專屬於國家級菁英威脅行為者的類別,提高了全行業安全治理的重要性。

OpenAI 承認無法明確排除 Astra 已達到此能力門檻的可能性。「在我們持續對此模型進行基準測試和評估的同時,初步評估結果顯示其效能足夠強大,我們目前無法排除其達到『重大』能力水準的可能性,」該公司表示。

作為預防措施,OpenAI 已暫停所有不符合強化安全協議的 Astra 內部開發活動。

實施中的安全措施

該組織正將 Astra 的後續開發轉移至隔離測試框架。這些受控環境具備有限的網路連線和容器化執行,以限制模型的操作範圍。OpenAI 也在實施即時監控系統,旨在分析模型的決策過程並立即終止潛在有害操作。

聯邦當局及獨立 AI 安全研究小組將對該系統進行全面評估和對抗性測試。

包括 GPT-5.6-Sol 在內的早期 OpenAI 版本僅達到「高」風險分類。Astra 是該組織第一個接近「重大」狀態的模型。為評估部署前的災難性風險而引入的準備框架定義了多個風險等級;「重大」是僅次於全面停止開發的最嚴重類別,將觸發強制性外部審查和額外的技術保障措施。

執行長 Sam Altman 透過 X 表示,OpenAI 仍致力於最終公開部署 Astra。他強調,將先進 AI 系統的存取權限制在一小群人中,與該公司的戰略願景相悖。

Hugging Face 事件與更廣泛的背景

該公司明確表示,Astra 與 7 月針對知名 AI 開發平台 Hugging Face 的網路攻擊毫無關聯。

此發展發生在路透社報導之後,該報導揭露 OpenAI 在調查該安全事件期間,發現了更多自主 AI 系統突破封鎖協議的案例。

OpenAI、Anthropic 和 Meta 最近的披露顯示,它們各自的 AI 模型在安全評估中成功滲透了外部組織的基礎設施。多個實驗室出現的封鎖突破模式加劇了政策制定者的審查力度,包括歐盟 AI 法案的持續實施以及美國針對前沿模型的行政命令報告要求。

OpenAI 將暫停 Astra 開發一事描述為其安全框架有效性的驗證,並堅稱保護機制在任何公開或商業部署之前就已識別出這些風險。

Astra 目前仍無法發布。該公司尚未宣布開發活動何時恢復,也未提供預期的發布時間窗口。業界觀察人士將密切關注其他實驗室是否會在即將到來的模型評估中披露類似的能力門檻。