訴訟、OpenAIが外部委託業者にChatGPTの会話を読ませていたと主張
重要ポイント
- •カリフォルニア州のユーザー2人が、OpenAIがユーザーへの十分な開示なしに外部委託業者へ実際のChatGPT会話を読ませていたと主張し、集団訴訟を予備的に提起しました。
- •訴状の中心は「Project Lily」で、人間のフィードバックによる強化学習(RLHF)の一環として、委託業者がユーザーのプロンプトを要約し、チャットボットの回答を1から7の尺度で評価するものです。
- •訴訟によれば、OpenAIの自動フィルターは個人情報をすべて除去するとは限らず、レビュアーのダッシュボードには、人の居住地、職業、私生活を明らかにし得る「ユーザーメモリー概要」が含まれていました。
- •OpenAIは、レビューはチャットボットが人間らしく振る舞いすぎることや過度に同調的(追従性)であることを抑えるためのものだと説明しています。
- •原告側は8つの請求に基づき損害賠償、原状回復、懲罰的損害賠償を求めるほか、オプトイン同意の義務付け、データ共有設定のデフォルトオフ化、チャット内警告を求める差し止め命令を請求しており、OpenAI回答期限は10月13日です。

カリフォルニア州のChatGPTユーザー2人が、OpenAIが適切な開示なしに外部委託業者へ実際のユーザー会話を読ませていたとして、集団訴訟を予備的に提起しました。本件は今月、カリフォルニア州北地区連邦地方裁判所に提起されました。OpenAIは9月2日に送達され、10月13日までに裁判所で回答する必要があります。
訴状の中心となるのは「Project Lily」で、これはOpenAIの内部プログラムであり、人材派遣会社を通じて雇われた委託業者がユーザーのプロンプトを要約し、チャットボットの回答を1から7の尺度で採点するものです。訴訟資料は、同社がユーザーに明確に事前通知することなく、実際のユーザーチャットを外部レビュアーに流していたと非難しています。
訴状によれば、「AIデータレビュアー」や「チャットボット評価者」といった役割で雇われた委託業者は、実際のChatGPTのプロンプトと会話全体を読み、ユーザーが何をしようとしていたかを要約し、その後、4つの異なるモデルの回答を1から7の尺度で採点・批評します。
このプロセス、ChatGPTのようなチャットボットが実際に改善される仕組みの基本的な形です。人間がAIの回答を採点し、その評価がトレーニングにフィードバックされることで、モデルは人々がどの回答を好むかを学習します。これは業界で人間のフィードバックによる強化学習(RLHF)と呼ばれる手法です。本訴訟の中核的な主張は、チャットを読むのが機械だけでなく人間である可能性があることを、ユーザーには明確に告知されていなかったという点です。また、RLHFは業界全体が依存する手法であるため、この争いはチャットボットの訓練方法そのものよりも、人間の目がユーザー会話に触れ得ることを企業がどれだけ明確に開示しなければならないかに焦点が移ります。
OpenAIは実際、人間が会話を見る前に自動システムを通しています。しかし訴状は、このフィルターがすべてを検出するとは限らず、個人情報が場合によっては委託業者に届いてしまうと主張しています。
Project Lilyは9月14日、メディア404 Mediaによって最初に暴露されました。同社の報道によれば、レビュアーは「ユーザーメモリー概要」を含むダッシュボードで作業を行っており、これは過去のチャットの要約であり、ユーザー名は削除されているものの、おおよその居住地、職業、私生活などの詳細が分かる可能性があるものです。
OpenAIは、こうしたレビューはチャットボットが人間らしく振る舞いすぎること、および過度に同調的であることという2つの具体的な行動を抑えるためのものだと説明しています。後者は研究者の間で「追従性(シコファンシー)」と呼ばれる特性で、AIが正確な情報ではなく、ユーザーが聞きたいと思うことを伝えてしまう現象を指します。
ChatGPTの週間ユーザー数は9億人を超え、多くのユーザーはそれを日記、セラピスト、あるいは自分だけが見られる検索エンジンのように扱っています。健康症状、別れのメッセージ、税務の質問、法的な問題などを入力しているのです。訴訟は、OpenAIのプライバシーポリシーにはユーザーデータにアクセスする外部の第三者のカテゴリーが一部記載されているものの、データアノテーションや人間による評価ベンダーはその中に明示されていなかったと主張しています。
訴状には8つの別個の法的請求がまれており、カリフォルニア州不正競争法および消費者プライバシー法違反のほか、プライバシー侵害(intrusion upon seclusion)といった普通法上の請求も含まれます。これは、常識的な感覚を持つ人なら不快と感じるような方法で他者の私事を覗き見る行為をカバーするプライバシー侵害です。原告側は損害賠償、原状回復、懲罰的損害賠償を求めています。
求められている差し止め命令は具体的です。原告側は、OpenAIに対し、会話が外部レビュアーに渡る前にオプトイン同意を必須とすること、「全員のためにモデルを改善する」設定をデフォルトでオフにすること、チャットウィンドウ内に明確な警告を表示すること、そしてレビューされた会話に関連する成果物を削除し、それを使用していたモデルの再トレーニングを行うことを求めています。この設定はすでに存在しますが、デフォルトではオンになっており、この種のレビューからチャットを除外したいユーザーは現在、自ら設定を見つけてオフにする必要があります。
本件はまだ予備的な集団訴訟であるため、より広範なユーザーを代表して進行するには集団訴訟の認証をクリアする必要があります。OpenAIの回答期限は10月13日です。