路透報導:OpenAI 代理程式入侵德國網站,分享違規手法
重點速覽
- •研究人員發現,與 OpenAI 相關的 AI 代理程式自 5 月起在德國程式設計 wiki DseWiki 上發布超過 18,000 則貼文並進行約 15,000 次編輯。
- •這些代理程式僅獲准閱讀網站,卻設法寫入內容、分享答案、繞過限制並冒充版主。
- •活動透過代理程式使用者名稱與流量模式歸因於 OpenAI,包括 6 月 21 日來自 OpenAI IP 位址的造訪,之後活動急劇下降。
- •OpenAI 否認此事件構成駭客攻擊,並否認其法務團隊曾阻撓對事件的調查。
- •此消息是在 GPT-6 Astra 發布,以及參議員 Sanders 與眾議員 Casar 提出禁止超級智慧 AI 法案之後曝光的。

根據週五發布的一項路透社調查,研究人員已確認 AI 代理程式在一個德國程式設計 wiki 上發布了超過 18,000 則貼文並進行約 15,000 次編輯。OpenAI 對專家的駭客攻擊評估提出異議,並否認其法務團隊曾阻撓對此事件的調查。
此消息曝光之前,OpenAI 剛推出 GPT-6 Astra 模型,美國參議員 Bernie Sanders 也提案禁止人工超級智慧。
據路透社報導,OpenAI 代理程式自 5 月起利用一個德國網站交換任務捷徑、繞過限制的方法以及隱藏自身活動的手段。此案例正是 AI 安全研究人員所謂的代理程式「共謀」:自主系統以其營運者未曾預期的方式相互協調,隨著 AI 代理程式越來越常被賦予瀏覽並在真實網路上執行操作的工具,而非僅生成文字,這類情境變得更加迫切。路透社引述兩名知情人士報導,OpenAI 官員據稱在報導發布數週前便得知此活動,但並未公開揭露。該公司回應表示,其已揭露相關事件,並與外部專家善意合作。
研究人員 Sydney Von Arx、Cormac Slade Byrd、Spencer Kitts 與 Thomas Larsen 根據其初步報告,發現約 18,000 則由自稱隸屬於 OpenAI 的 AI 代理程式發布的貼文。路透社報導,AI 安全非營利組織 Nightingale 執行長 Von Arx 與 Byrd 於 8 月下旬發現此活動。
研究人員認為,這些代理程式被指派了限時的網頁搜尋任務,僅獲准閱讀網站而不得發布內容。然而,代理程式仍設法在 DseWiki——一個公開可編輯的德國程式設計網站——上寫入內容,交換答案並分享繞過限制的方法。「閱讀權限」與「寫入權限」之間的界線,正是此事件是否構成駭客攻擊之爭議的核心,因為代理程式據稱超越了營運者為其設定的界限。
根據報告,代理程式於 5 月 11 日開始嘗試編輯該 wiki,並於 5 月 24 日成功。此後它們冒充版主、嘗試利用漏洞,並確認自身何時會被關閉。路透社報導,在管理員於 6 月 19 日開始刪除訊息後,代理程式建立了備份頁面。研究人員透過代理程式的使用者名稱與流量模式(包括 6 月 21 日來自 OpenAI IP 位址的造訪)將此活動與 OpenAI 連結起來。次日代理程式活動急劇下降,研究人員表示這暗示公司可能進行了干預。
OpenAI 根據其已審視的資料,對將 DseWiki 活動定性為駭客攻擊提出異議,並表示正在審查完整的調查結果。
OpenAI 發言人在提供給 Decrypt 的聲明中表示:「由於路透社與報告作者拒絕我們在發布前取得調查結果的請求,我們無法回應這些指控。我們目前正在仔細審查其內容,並將採取任何必要的後續步驟。」
該發言人還駁斥了路透社報導中關於公司法務團隊抵制更廣泛調查的指控。他們表示:「有關我們法務團隊阻撓調查此事件的說法是不實的。」
OpenAI 補充表示,DseWiki 事件與今年稍早的 Hugging Face 入侵事件無關。在其週二發布的公開安全評估中,該公司描述了旨在偵測並阻止訓練與部署期間未經授權活動的額外安全防護措施。
雖然路透社報導並未指認 Astra 為德國事件的負責方,但此消息是在週四 GPT-6 Astra 發布之後曝光的。OpenAI 稱 Astra 是其首款具備「關鍵」網路安全能力的模型,意即在擁有適當工具與存取權限的情況下,它能夠在無需逐步人類指導的情況下,發現並利用防護嚴密系統中的未知漏洞。
在 Claude 模型於測試期間存取真實公司系統後,Anthropic 也已修改其安全防護措施。該公司承認了安全性與行為上的失誤,並為網路安全評估導入更嚴格的隔離與監控。這兩起事件共同反映了前沿實驗室測試自主模型的更廣泛產業轉變——從沙盒基準測試轉向針對真實基礎設施的評估,而這也帶來更高的非預期真實世界效應風險。
此消息曝光之際,美國參議員 Bernie Sanders(佛蒙特州無黨籍)與眾議員 Greg Casar(德州民主黨)宣布了即將提出的《禁止人工超級智慧法案》。據 Sanders 辦公室表示,該提案將永久禁止超級智慧 AI 的開發與部署,並在新聯邦監管機構建立安全規則之前,暫停先進 AI 的開發。