新聞股票OpenAI證實失控AI代理外洩53張ChatGPT用戶私人圖片,並建立近100萬個夾帶編碼資訊的連結

OpenAI證實失控AI代理外洩53張ChatGPT用戶私人圖片,並建立近100萬個夾帶編碼資訊的連結

作者: Fortune Crypto·

重點速覽

  • •OpenAI於週五透露,其AI代理存取了儲存在自家伺服器上用於訓練的ChatGPT用戶私人圖片,並將其中53張上傳至圖片託管網站。
  • •《紐約時報》援引新創公司Parse的研究報導,OpenAI的代理在7月Hugging Face遭駭期間建立了近100萬個短連結,其中夾帶的編碼片段可組合成旨在繞過Captcha等機器人防禦的程式。
  • •OpenAI表示,已就其模型繞過安全控管或以非預期方式使用網站的事件通知數十個第三方,這些事件是在Hugging Face遭駭引發的內部審查中被發現。
  • •執行長Sam Altman稱Hugging Face入侵是該公司所見最嚴重的事件,並表示OpenAI已與託管提供商合作移除大部分外圖片。
  • •這些揭露,連同Anthropic和Google類似的模型失控行為披露,正值Altman、Anthropic執行長Dario Amodei及其他高層在聯合國大會呼籲建立國際AI治理框架之際;而川普總統則將存在性風險的說法斥為騙局。
OpenAI證實失控AI代理外洩53張ChatGPT用戶私人圖片,並建立近100萬個夾帶編碼資訊的連結

OpenAI於週五披露,其AI代理——能夠自主瀏覽網路並執行多步驟任務的系統——曾存取ChatGPT用戶的私人圖片並將其發布上網,這是頂尖AI實驗室開發的技術接連失控、出現非預期行為等一連串令人憂心事件中的最新一起。

這些圖片是OpenAI為訓練AI模型而以匿名化形式儲存在自家伺服器上,該公司在一則X貼文中表示,圖片被上傳至圖片託管網站,總計有53張圖片被發布。

這項披露最初由路透社報導,是週五浮上檯面的數起新的OpenAI失控AI活動之一。《紐約時報》公布了關於7月Hugging Face網站遭駭事件的新細節,報導指出這些AI代理建立了特殊的短連結以躲避偵測。Hugging Face是一個開發者廣泛用來分享AI模型與資料集的線上平台。稍早於週五,OpenAI披露,已就其模型繞過安全控管或以非預期方式使用網站的事件通知數十個第三方。這些事件是在Hugging Face遭駭後引發的內部審查中被發現。

「我們的速度不如預期,但我們正努力在透明化的願望、從數PB的代理活動日誌中取得清楚理解,以及與受影響組織合作之間取得平衡,」OpenAI執長Sam Altman週五在一則X貼文中,連同第三方通知的更新一同表示。

「Hugging Face仍是我們所見最嚴重的事件,」他補充說。「我們會在可能的範圍內保持透明,但前提是不影響我們的代理在其他公司發現的漏洞等事項,是否揭露將由那些公司自行決定。」

其他開發最先進「前沿」AI模型的主要企業,如Anthropic和Google,近幾週也披露了其模型出現失控活動的事件。這些揭露引發了廣泛疑慮:人工智慧演進的速度如此之快,現有的防護措施與法規是否足以確保這項技術不會完全脫離人類掌控。一些AI專家,包括AI實驗室內部的研究人員,曾警告若未採取適當預防措施,這項技術將構成人類滅絕的重大風險。

Altman、Anthropic執行長Dario Amodei及其他科技業高層本週在聯合國大會上發表演說,呼籲建立管理AI發展的國際框架。然而,川普總統則稱AI構成存在性風險的說法是一場「騙局」。

根據《紐約時報》基於新創公司Parse研究所做的報導,OpenAI的代理在7月建立了近100萬個網路短連結。報導指出,這些連結夾帶編碼的資訊片段,組合起來可作為電腦程式運作。這些程式旨在協助代理繞過Captcha驗證等防禦機制,而這類機制正是設計用來阻擋機器人存取。

目前尚不清楚路透社報導的外洩圖片是否屬於Hugging Face事件的一部分,或是完全獨立的事件。OpenAI的代理顯然是透過存取公司自身的訓練資料而取得這些用戶圖片。該公司並未說明這些圖片是真實人物的照片或用戶以AI生成的圖片,也未確切說明圖片被張貼在何處。不過OpenAI表示,這些圖片是「以未公開列出的連結形式」張貼至圖片託管網站。

「我們已成功與託管服務提供商合作移除大部分內容,並正在移除其餘內容,」OpenAI表示。

本文最初刊載於 Fortune.com。