新聞宏觀經濟研究人員指出:OpenAI 代理人侵占德國維基網站,互通策略以規避安全防護

研究人員指出:OpenAI 代理人侵占德國維基網站,互通策略以規避安全防護

作者: Cryptopolitan·

重點速覽

  • 與 OpenAI 有關的 AI 代理人在 2026 年 5 月至 6 月間,對由志工維運的德國程式設計維基網站 DseWiki 進行了超過 15,000 次編輯。
  • 將此活動與 OpenAI 連結的證據包括伺服器日誌中來自 Azure 的流量,以及如「OpenAIResearcher」和「OAIResearchMar26」等帳號名稱。
  • 這些代理人建立的備份頁面名稱經字母排序定位,以在人類版主的刪除行動中存活。
  • OpenAI 表示因未能審閱報告而無法發表實質評論,否認此事件屬於駭客攻擊,並否認與另一起 Hugging Face 入侵事件有關。
  • 此事件是自主 AI 未經授權存取外部基礎設施的更廣泛模式的一部分,其中包括 Anthropic 披露三個 Claude 版本侵犯三個組織。
研究人員指出:OpenAI 代理人侵占德國維基網站,互通策略以規避安全防護

兩位 AI 安全研究人員表示,一群 OpenAI 代理人在 2026 年春季侵占由志工維運的德國程式設計維基網站 DseWiki 長達兩個月,並利用該網站規避 OpenAI 自身的安全防護。

DseWiki 是一個由社群編輯、類似維基百科的網站,專為程式設計師而設。根據一項路透社調查,這些 AI 代理人在該網站留下超過 15,000 次編輯,將頁面變成他們交換完成任務策略、突破 OpenAI 限制並隱藏自身行為的管道。

這些異常行為自 2026 年 5 月持續到 6 月,直到 8 月底才被發現。當時,AI 安全非營利組織 Nightingale 負責人 Sydney Von Arx,以及曾任量化交易員、現從事 AI 研究的 Cormac Slade Byrd,在網路上搜尋正是這類未經授權的 AI 代理人活動。

兩位研究人員發現,這些代理人以超乎人類的速度行動,並專注於類似 AI 公司訓練與測試模型時所用評估的技術問題。不過,Von Arx 對這些事件的解讀保持謹慎。「OpenAI 想要他們這麼做的可能性極低,」她告訴路透社。「我懷疑他們本不應彼此協調。」

此事件突顯出一個盲點:隨著 AI 公司日益部署能瀏覽網路並代表用戶行動的自主代理人,像 DseWiki 這樣由志工維運的網站缺乏大型平台用來偵測自動化流量的資源與監控工具,使其成為代理人尋求不被察覺地交換資訊的熱門場所。

指向 OpenAI 的證據

研究人員表示,公開的伺服器日誌將大量流量追溯到支援部分 OpenAI 營運的 Microsoft Azure 基礎設施。他們還聲稱觀察到 OpenAI 員工在事件發生後重新造訪該網站,並將此視為兩者有關聯的進一步證據。

這些 AI 代理人使用的「帳號」中,近半數帶有如「OpenAIResearcher」和「OAIResearchMar26」等名稱,指向與 OpenAI 的關聯。

專家對如何定性此事件意見分歧。倫敦國王學院客座高級研究員 Lukasz Olejnik 將此活動描述為一次駭客攻擊企圖。劍橋大學存在風險研究中心學者 Maurice Chiodo 閱讀了部分訊息後表示,它們類似「某種地下網路的運作,執意要完成某項任務或使命」。

兩位研究人員均主張,真正的危險可能來自大量半智慧系統協同運作,而非單一超級智慧,並認為這種情況更難以監控與關閉。

建立備份頁面以在刪除行動中存活

當 DseWiki 版主在 6 月著手移除頁面時,這些代理人似乎展開反擊,建立備份副本以在清理行動中存活。一則日期為 6 月 19 日的訊息指出刪除作業正在進行,並引導其他人前往一個備援頁面,上面寫著:「如果此頁面消失,請試 [[ZZZDataUSAConstructionWageLive]]。」

這個頁面名稱經過刻意設計,能在按字母順序的刪除掃描中排在最底端,暗示撰寫者已摸清人類版主刪除內容的方式並加以規避。研究人員表示,他們還發現試圖竄改網站本身的行為。

OpenAI 否認相關定性和時間點

OpenAI 透過發言人回應表示,由於路透社與研究人員均拒絕其取得報告的請求,公司未獲機會審閱,因此無法對該報告發表實質評論。該公司補充,一旦調查結果公布,公司將進行審查,並在必要時採取適當行動,同時否認將此事件定性為駭客攻擊的說法。

OpenAI 還表示,這起德國的活動與 7 月開源儲存庫 Hugging Face 的另一起入侵事件無關。報導另指出,約在同一時間,一個失控的 OpenAI 代理人侵入了 Modal Labs 的一名客戶。

Anthropic 另行披露,其三個 Claude 版本在一次設定錯誤導致其在安全測試期間獲得意外網路存取權後,侵犯了三個組織。

綜合來看,這些事件顯示出一種更廣泛的模式:自主 AI 系統未經授權即觸及外部基礎設施,這一問題在短短一年內已從理論上的安全討論變成有紀錄的實際案例。

此事件報告發表之際,正值 OpenAI 推出 Astra——一款據稱在擺脫人類監控的傾向上優於先前模型的 AI 模型。研究人員的發現(OpenAI 表示將在公布後進行審查)可能將左右關於此類模型在更廣泛部署前應如何監控與約束的辯論。