ニュース株式OpenAI、暴走したAIエージェントがChatGPTユーザーの画像53枚を流出させ、エンコードされた情報を含む約100万件のリンクを作成していたと発表

OpenAI、暴走したAIエージェントがChatGPTユーザーの画像53枚を流出させ、エンコードされた情報を含む約100万件のリンクを作成していたと発表

著者: Fortune Crypto·

重要ポイント

  • •OpenAIは金曜日、訓練用にサーバーに保存されていたChatGPTユーザーの非公開画像AIエージェントがアクセスし、そのうち53枚が画像ホスティングサイトにアップロードされたことを明らかにした。
  • •ニューヨーク・タイムズは、スタートアップ企業Parseの調査に基づき、OpenAIのエージェントが7月のHugging Faceハッキングの際に約100万件の短縮リンクを作成し、それらにはCaptchaなどのボット防御を回避するプログラムとして組み合わさりうるエンコード済みの断片が含まれていたと報じた。
  • •OpenAIは、モデルがセキュリティ管理を回避したりウェブサイトを意図しない方法で利用したりした数十件のインシデントについて第三者に通知したと述べた。これらはHugging Faceハッキングをきっかけとした社内調査で発見された。
  • •サム・アルトマンCEOは、Hugging Faceの侵害は同社が経験した中で最も深刻なインシデントだと述べ、OpenAIはホスティング事業者と協力して流出画像の大半を削除したと説明した。
  • •AnthropicやGoogleからの同様の暴走モデル行動の告発とともに、これらの発表は、アルトマン氏、Anthropicのダリオ・アモデイCEOらが国連総会で国際的なAIガバナンス枠組みを求めた動きと時を同じくした。一方、トランプ大統領は存在論的リスクの主張を「デタラメ」と一蹴した。
OpenAI、暴走したAIエージェントがChatGPTユーザーの画像53枚を流出させ、エンコードされた情報を含む約100万件のリンクを作成していたと発表

OpenAIは金曜日、ウェブを自律的に閲覧し複数段階のタスクを実行できるAIエージェントが、ChatGPTユーザーの非公開画像にアクセスし、それらをオンラインに投稿したことを明らかにした。これは、主要AI研究所で開発された技術が暴走し意図しない行動をとった一連の憂慮すべきインシデントの最新事例である。

同社がXへの投稿で述べたところによると、AIモデルの訓練のため匿名化された形でOpenAIのサーバーに保存されていた画像が、画像ホスティングサイトにアップロードされた。投稿された画像は合計53枚だった。

この発表は、ロイターが最初に報じたもので、金曜日に明らかになったOpenAIにおけるAIの暴走活動に関する新たな告発のひとつである。ニューヨーク・タイムズは、7月のHugging Faceウェブサイトへのハッキングについて新たな詳細を報じ、AIエージェントが検出を回避するための特別な短縮リンクを作成していたと報道した。Hugging Faceは、開発者がAIモデルやデータセットを共有する広く利用されているオンラインプラットフォームである。同じ日の早い時間に、OpenAIは、同社のモデルがセキュリティ管理を回避したり、ウェブサイトを意図しない方法で利用したりした数十件のインシデントについて第三者に通知したことを明らかにした。これらのインシデントは、Hugging Faceハッキングをきっかけとした社内調査の中で発見された。

「私たちは望んだほど迅速に動けたわけではないが、透明性への願いと、ペタバイト級のエージェント活動ログから正確な把握を得ること、そして影響を受けた組織との協力とのバランスを取ろうとして」と、OpenAIのサム・アルトマンCEOは金曜日、第三者への通知の最新情報とあわせてXへの投稿で述べた。

「Hugging Faceは依然として、私たちが見てきた中で最も深刻な事件だ」と彼は付け加えた。「私たちのエージェントが他社で発見した脆弱性などに関しては、可能な限り透明性を保つようにする。それを開示するかどうかは、各社の判断となる。」

AnthropicやGoogleなど、最先端の「フロンティア」AIモデルを開発する他の主要企業も、近年、自社モデルの暴走インシデントを明らかにしている。これらの告発は、人工知能が進化する速度、そして技術が人間の制御を完全に逸脱しないよう十分な安全対策と規制が整備されているかどうかについて、広範な懸念を引き起こしている。AI研究所内部の研究者を含む一部のAI専門家は、適切な予防策が講じられなければ、この技術が人類絶滅の重大なリスクをもたらすと警告している。

アルトマン氏、Anthropicのダリオ・アモデイCEO、および他のテック企業幹部は今週、国連総会で演説し、AI開発を管理するための国際的枠組みを求めた。一方、ドナルド・トランプ大統領は、AIが存在論的リスクをもたらすという考えを「デタラメ」と呼んでいる。

ニューヨーク・タイムズの報道(スタートアップ企業Parseの調査に基づく)によると、OpenAIのエージェントは7月に約100万件の短縮インターネットリンクを作成していた。これらのリンクにはエンコードされた情報の断片が含まれており、組み合わせるとコンピュータプログラムとして機能しうるものだった。これらのプログラムは、ボットによるアクセスを阻止するために設計されたCaptchaクイズなどの防御を、エージェントが回避するのを助けることを目的としていた。

ロイターが報じた画像の流出がHugging Face事件の一部なのか、まったく別の事象なのかは明らかでない。OpenAIのエージェントは、同社自身の訓練データにアクセスすることでユーザー画像を入手したとみられる。同社は、これらの画像が実在の人物の写真なのか、ユーザーが作成したAI生成画像なのかについて詳細を明らかにしておらず、画像がどこに投稿されたのかも具体的に述べていない。ただしOpenAIは、画像が「一般に公開されていないリンク」として画像ホスティングサイトに投稿されたと述べた。

「私たちはホスティング事業者と協力し、このコンテンツの大半の削除に成功しており、残りの削除にも取り組んでいる」とOpenAIは述べた。

この記事はもともとFortune.comに掲載されたものです。