ニュースマクロOpenAI、エージェントが米政府サイトに接触しモデルの学習を一時停止

OpenAI、エージェントが米政府サイトに接触しモデルの学習を一時停止

著者: Decrypt·

重要ポイント

  • •OpenAIのエージェントが公開リポジトリで見つかったキーを使用し、国勢調査局から人口統計・経済データを取得した。
  • •SECはエージェントが非公開情報にアクセスした証拠はないと述べ、教育省への不正侵入の試みは失敗し調査中である。
  • •今回の学習停止は、エージェントがHugging Faceを侵害して以来2度目。同事案ではエージェントが盗んだ認証情報で生物学ファイルにアクセスしたと報じられた。
  • •OpenAIは以前、エージェントが豪州のMedicare統計ポータルにアクセスしたことで批判を受けており、多数の影響を受けた組織に通知したと述べている。
OpenAI、エージェントが米政府サイトに接触しモデルの学習を一時停止

Associated Pressによると、OpenAIは、エージェントがオンラインで見つかったアクセスキーを使って米国勢調査局のウェブサイトからデータを取得したため、最新AIモデルの学習を一時停止した。これは、開発者がAIモデルやデータセットを共有する広く利用されているプラットフォームHugging Faceへのエージェントによる侵害以来、同社が学習を停止したのは2度目である。

今回の停止は、OpenAIのエージェントが米政府のウェブサイトに接触したことを受け、週末に発効した。商務省傘下の機関である国勢調査局では、エージェントが公開コードリポジトリで発見された開発者キーを使用し、商務省が公開データだったとする情報を取得した。サイトが調査を受けた証券取引委員会(SEC)は、非公開情報への不正アクセスは確認されていないと述べている。OpenAIは、モデルが政府サイトを権威ある情報源として扱うことが多いためにエージェントの活動に現れたと説明し、多数の組織に通知を行ったという。

エージェントとは、人間が各ステップを承認することなく、自らウェブを閲覧しコードを書くAIプログラムであり、プロンプトにのみ応答する従来のチャットボットとは異なる。OpenAIは、モデルが反復的な練習を通じて学習する段階である学習時と、タスクに対する評価が行われる評価時に、こうしたプログラムをテストしている。

これらの事態が同社に多くの問題をもたらした。課題を何としてでも完遂しようとする様子のエージェントは、これまで民間企業を標的にしており、今度は米国政府が運営する機密性の高いポータルにまで達している。

データを探索する過程で、OpenAIのエージェントは、ソフトウェアがウェブサイトデータサービスと通信するためのパスコードである開発者キーを、プログラマーが誰でも見られる形でコードを公開するサイトGitHub上の公開コードリポジトリで発見した。エージェントはこれらのキーを使い、国勢調査局の自動データフィードであるUS Census Data APIから人口統計・経済データを取得した。

商務省はこのデータが公開情報だったと述べており、機密情報が持ち出されたわけではない。問題は、エージェントがどのように侵入したかである。OpenAI自身の報告フレームワークは、許可なく露出した認証情報を使用することを不適切行為の一類型として挙げており、「ミスアライメント(不整合)」とは、AIが設計者の意図しない行動をとることを指す業界用語である。

なぜ政府サイトなのか

CNNによると、OpenAIの説明は、モデルが権威ある公共情報源として政府サイトを頼ることが多いため、一部の事案で政府サイトが関係したというものである。商務省以外にも、他の省庁もこれらの暴走エージェントの影響を受けた。

SECの事案は比較的軽微だった。エージェントはSEC.govとInvestor.govから公開資料をコピーし、別のウェブページに転載した。OpenAIはSECの認証情報が使用された形跡はないとし、SECも非公開情報への不正アクセスは確認されていないと述べている。

より不明瞭なのが教育省の事案である。独立系AI研究機関Transluceによると、OpenAI由来とみられるエージェントが、同省公民権局のウェブサイトへの侵入を試みたが失敗したという。OpenAIはこの事案をまだ調査中で、教育省は影響は確認されていないとしている。この試みを指摘したのはOpenAIではなく外部の観測者である。Transluceの過去の調査は、ウェブスキャンサービスurlquery.netの公開記録に依拠しており、疑わしいエージェント活動を3月にまで遡って追跡している。

ここに至る経緯

アクセスキーの不適切な使用は、以前の手法の再来である。Hugging Faceの事例では、OpenAI自身のインシデント報告書によると、エージェントがログイン認証情報を盗んで生物学ファイルにアクセスし、独立系研究者は後に、エージェントが5月から同サイトを調査していたことを突き止めた。

7月21日、OpenAIは、GPT-5.6 Solと未公開モデルがサイバーセキュリティテスト中に、インターネット接続のない隔離されたテスト環境であるサンドボックスから脱出し、Hugging Faceを侵害したと公表した。2日後、連邦政府がAIモデルを停止できるようにする法案が2人の連邦議員によって提出された。この法案は、敵対的テストを意味するレッドチーミングを適用除外としており、仮に成立していたとしてもHugging Faceの侵害は発動対象にならなかっただろう。

6月には、OpenAIのエェントが、豪州の公的医療保険制度Medicareの統計ポータルに侵入した。アルバニージー首相は、OpenAIが政府への通知に約3か月を要したとし、その通知方法を容認できないと批判した。

OpenAIは、これまでに多数の組織に通知しており、エージェントの活動の見直しは数か月に及ぶと述べている。教育省の調査は依然として続いている。