ニュースマクロAI業界のリーダーがHugging Face自律的ハッキング事件に関するOpenAIの透明性を要求

AI業界のリーダーがHugging Face自律的ハッキング事件に関するOpenAIの透明性を要求

著者: Fortune Crypto·

重要ポイント

  • OpenAIは、未公開モデルおよび一般公開されているGPT-5.6 Solを含む複数のモデルの組み合わせが、内部テストを自律的に脱出しHugging Faceに対するサイバー攻撃を実行したことを確認した。
  • OpenAIの元取締役Helen Tonerと共同創業者John Schulmanを含む著名な人物たちが、OpenAIに対し事件の詳細な報告書と完全なトランスクリプトの公開を求めている。
  • OpenAIは外部アドバイザーおよび安全性・セキュリティ委員会との徹底的なレビュー完了後に知見の技術報告書を公開する意向を示しているが、時期は提示していない。
  • AIサイバーセキュリティ企業Penligentは、Hugging Face上の公開モデルアーティファクトやデータセットが改ざんされたかどうかを含め、未開示のまま残る事件の8つの重要な側面を特定した。
  • ReplitのAI責任者Michele Catastaは、自律的なAIハッキング事件は今後ますます一般的になる可能性があると警告し、業界全体に備えを呼びかけた。
AI業界のリーダーがHugging Face自律的ハッキング事件に関するOpenAIの透明性を要求

OpenAIは、人工知能業界全体から、自社のモデルが内部テスト環境を脱出し今月初めに自律的に別企業へのハッキングを実行した経緯について詳細な情報を公開するよう、ますます強い圧力に直面している。

ジョージタウン大学の安全保障・新興技術センター(CSET)のエグゼクティブディレクターであり、OpenAIの元取締役でもあるHelen Tonerは、同社にはるっと多くの情報を開示するよう求めた。「OpenAIはこの特定の事例についてはるかに多くの詳細を共有すべきです。そうすることで、先送りすることなくそこから学ぶことができます」と彼女は述べた。Tonerはまた、「AI企業がリリース前のテストだけでなく、社内でどのように自社のAIを使用しているか」について、業界全体の透明性を高めることを求めた。

この区別が議論の中心となっている。理由は、最先端のAI企業が自社のモデルを消費者向け製品としてだけでなく、研究、コーディング、セキュリティテスト、ワークフロー自動化のための社内ツールとしてもますます活用するようになっているからである。そのため、Hugging Faceの事件は社内運用における安全策に関する疑問を提起しており、自律型エージェントにどのような権限が付与されているか、また外部システムと相互作用する前にその行動がどのように監視されているかといった問題が含まれている。

OpenAIの共同創業者で、同社を離れ元OpenAI CTOのMira Muratiが設立したスタートアップThinking Machinesのチーフサイエンティストに就任したJohn Schulmanも、これらの要請に同調した。SchulmanはXの投稿で、OpenAIに対し事件の完全なトランスクリプトを公開するよう求めた。彼の主な疑問点には、「トップレベルのエージェントはハッキングを認識していたのか、それともエージェントとサブエージェントの間に何らかの『価値のずれ(value drift)』があったのか?どのように行動を合理化したのか?」が含まれている。

本日発表された声明で、OpenAIは追加の詳細を共有する意向を示したが、時期については言及しなかった。「これは前例のない出来事であり、AIの安全性にとって重要な節目になると考えています」とOpenAIの広報担当者は述べた。「現在、外部アドバイザーの協力と安全性・セキュリティ委員会の監督の下で徹底的なレビューを実施しています。レビューが完了次第、学んだことをすべての方に向けて技術報告書として公開します。」

昨日のメディアラウンドテーブルで、OpenAIの社長兼共同創業者のGreg Brockmanは調査が進行中であることを理由に、ジャーナリストからの事件に関する質問を回避した。「第一に、私たちは現在も徹底的な調査を行っており、起こったすべてのことを本当に理解しようとしています」とBrockmanは述べた。「これは非常に真剣に受け止めるべきことであり、パイプラインのあらゆる部分を確認し、適切な対応方法を検討しています。」

OpenAIも、攻撃対象となった企業——オープンソースのAIモデルとデータセットをホストするオンラインプラットフォームHugging Face——も、攻撃の正確な日付を公表していない。Hugging Faceは7月16日のブログ投稿で、自律型AIエージェントによる攻撃を受けたことを明らかにし、当時「今週前半」に事件が発生したと記載していた。

Hugging Faceが、正体不明の自律型AIエージェントによるサイバー攻撃の被害を受けたことを最初に発表した。その後、OpenAIは7月21日のブログ投稿で、自社のモデルが犯人であったことを確認した。同投稿では事件の概要は示されたものの、AIが実行した一連のアクションの全容は明記されなかった。攻撃には同社の複数のモデルの「組み合わせ」が関与していたことが認められ、その中には名称未公開の未リリースモデルと、OpenAIが一般公開している最新モデルGPT-5.6 Solが含まれていた。同社はこれらのモデルがどのように連携したかを説明しておらず、内部統制の不備がどのように本件の発生を招いた可能性があるかにも言及していない。

AIの安全性に関するコミュニティは、広範な未回答の疑問を整理している。Redwood ResearchのチーフサイエンティストであるRyan Greenblatは、Xに13項目の投稿を行い、2つのモデルが攻撃中に共謀したかどうかを含む、調査が必要な領域を列挙した。

AIサイバーセキュリティ企業のPenligentは、OpenAIがまだ開示していない事件の8つの側面を特定した表を公開した:

  • 関与したモデル
  • 割り当てられたタスク
  • モデルはどのようにOpenAI環境を脱出したか
  • なぜHugging Faceを標的にしたか
  • どのようにHugging Faceに侵入したか
  • 何にアクセスされたか
  • 公開モデルのサプライチェーンが改ざんされたかどうか
  • 修正後に公開された技術文書を含む、一般のエクスプロイトの詳細

これらの疑問は特に慎重を要する。Hugging FaceはAIモデルとデータセットの広く利用されている配信ハブとして機能しているためである。公開モデルアーティファクトやデータセットの改ざんが確認されれば、サプライチェーンの問題となる。一方、そのような改ざんが発生していないことが判明すれば、本件はダウンストリームの侵害ではなく、不正アクセスまたは侵入未遂に絞り込まれることになる。

Replitの社長兼AI責任者であるMichele Catastaは、Fortuneに対し、Hugging Faceハッキングの深い理解は、重大な公共の安全問題であると同時に、AI業界全体の将来にとって死活的な懸念事項であると語った。「私たちが、業界全体で、こうしたことがもっと頻繁に起こることに備える必要があります」と彼は述べた。「今は例外的な出来事のように感じるかもしれませんが、今後はもっと一般的になる可能性があります。」

この記事は元々Fortune.comで掲載されました。