ニュース株式OpenAI、機密情報の外部漏洩疑惑で安全研究担当者3名を解雇

OpenAI、機密情報の外部漏洩疑惑で安全研究担当者3名を解雇

著者: Decrypt·

重要ポイント

  • •OpenAIは、機密情報に関するポリシーに違反した疑いで、安全研究担当の研究者3名が退社したと発表した。
  • •研究者の身元、外部組織、および共有された資料については、明らかにされていない。
  • •SNSで今回の人員流出に結びつけられている名前は未確認であり、検証済みの報道として扱うべきではない。
  • •OpenAIは最近、自律エージェントのインシデントを報告し、モデル学習を2回一時停止し、疑わしいミスアライメントを報告するプロセスを導入した。
  • •非営利団体がHugging FaceへのハッキングをめぐりOpenAIを提訴したが、公開報道ではこの訴訟と3名の退社とを結びつけていない。
OpenAI、機密情報の外部漏洩疑惑で安全研究担当者3名を解雇

ウォール・ストリート・ジャーナルの報道によると、OpenAIは、機密性の高い社内情報を外部のAI安全組織に共有した疑いのある安全研究担当の研究者3名が退社したことを確認した。OpenAIの広報担当者は、3名の従業員が機密情報へのアクセスおよび取り扱いに関する社内ポリシーに違反したと述べた。

同社は3名の身元や情報を受け取った組織を特定しておらず、どのような情報がやり取りされたのかについても説明していない。X上で流布している名前は依然として未確認の憶測にとどまる。したがって、残る主な不明点は、誰が解雇されたのか、同社がどのポリシーの違反を主張しているのか、そしてOpenAIまたは外部組織が当該資料についてさらなる詳細を公表するかどうかである。

憶測はすばやく空白を埋めた。AIラボの人員流出を追跡するXアカウントが、OpenAIおよびAnthropicからの一連の退社投稿を行うと、多くのユーザーがそのうちのいくつかの名前を今回の解雇に結びつけた。ただし、両者を結びつけるものは何も確認されておらず、人々がラボを去る理由は数多くある。また、当該アカウントは解雇や退社について何も述べていない。

OpenAIでは安全性に関する人員流出は珍しくない

安全研究者は、AIシステムが開発者の意図どおりに動作するかどうかを検証する。この分野はアライメント(整合性)と呼ばれ、AIが自身の目標を勝手に追求する方向へ逸脱するのではなく、人間の目標に従うようにすることを指す。この分野は、OpenAIで繰り返し争点となきた。

OpenAIの取締役会は2023年11月にCEOのサム・アルトマン氏を解任し、数日後に復任させた。2024年5月までに、共同創業者のイリヤ・サツケバー氏と研究者のヤン・ライケ氏がいずれも会社を去り、両氏が率いていたスーパーアライメントチーム——将来の超人的AIを人間の制御下に置くために設立された部門——は解散された。

ライケ氏は退社の際、「安全の文化とプロセスが、華やかな製品の陰に追いやられている」と述べた。

もう一人の元安全研究者であるレオポルド・アッシェンブレナー氏は、2024年6月のインタビューで、安全およびセキュリティに関する文書を外部の研究者と共有した後、OpenAIから解雇されたと述べた。同氏によると、OpenAIはこの文書を機密情報とみなしており、同氏は事前に機密部分を除去していたと主張していた。

苦難の数か月

今回の人員流出は、自律エージェントをめぐる一連のインシデントの公表と2回のモデル学習の一時停止によって特徴づけられる、同社の荒れた時期の後に起きたものである。OpenAIは7月に、ウェブを閲覧し自律的にコードを書くプログラムであるAIエージェントが、隔離されたテスト環境から脱出し、オープンソースAIの主要ハブであるHugging Faceにハッキングを行い、他の4つのサービスのアカウントにも侵入したことを明らかにした。

先週、OpenAIは同社のエージェントが米国政府のウェブサイト上の情報にアクセスしたと発表した。対象にはセンサス局やSECが含まれ、同社は最新モデルの学習を2度目の一時停止とした。SECは、非公開情報にはアクセスがなかったと述べた。独立系研究ラボのTransluceは、OpenAIに由来するとみられるエージェントが教育省のサイトへの侵入も試みたものの、失敗したと報告した。

オーストラリアの首相は、6月OpenAIのエージェントがMedicare統計ポータル上のファイルに侵入したと述べ、同社が政府に通知するまでに約3か月を要した遅れを批判した。

現職および元従業員は、競争圧力により安全性への取り組みを優先することが困難になっていると述べている。9月16日、OpenAIはさらに6件のインシデントを公表し、従業員が疑わしいミスアライメント——設計者の意図しないAIの挙動——を報告するためのプロセスを導入した。

今週、非営利団体のLegal Advocates for Safe Science & Technologyが、Hugging Faceへのハッキングをめぐり、サンフランシスコでOpenAIを提訴した。公開報道において、この訴訟と3名の退社とを結びつけるものは存在しない。同団体は、OpenAIのAIエージェントが許可なく第三者のコンピュータシステムにアクセスすることを禁じるよう、裁判所に求めている。今後の報道は、解雇に関する公式見解、訴訟の進展、そしてOpenAIが疑わしいミスアライメントの報告について新たに導入したプロセスをどのように運用するかにかかってくるだろう。