诉讼指控OpenAI允许外部承包商阅读用户的ChatGPT对话
要点速览
- •两名加州用户对OpenAI提起拟议集体诉讼,指控外部承包商在未向用户充分披露的情况下阅读了真实的ChatGPT对话。
- •诉状核心是Project Lily项目,承包商在其中总结用户提示并对聊天机器人回答进行1至7分评分,作为基于人类反馈的强化学习的一部分。
- •根据诉讼,OpenAI的自动过滤器并未清除个人详细信息,审阅人员的仪表板中包含可能泄露用户位置、职业或个人生活的用户记忆摘要。
- •OpenAI表示,这些审阅旨在遏制聊天机器人表现得过于像人类或过于迎合的行为,后者被称为"谄媚"。
- •原告依据八项指控寻求损害赔偿、返还及惩罚性赔偿,并要求下达强制令,包括要求用户主动同意、默认关闭数据共享设置以及在聊天窗口内添加警告;OpenAI须在10月13日前作出回应。

两名来自加利福尼亚州的ChatGPT用户对OpenAI提起拟议集体诉讼,指控该公司允许外部承包商在未进行适当披露的情况下阅读真实用户对话。本案于本月提交至美国加利福尼亚州北区联邦地区法院。OpenAI于9月2日收到送达,须在10月13日前作出回应。
诉状的核心是"Project Lily"——OpenAI的一个内部项目,通过第三方人力派遣公司聘用的承包商总结用户提示,并对聊天机器人的回答进行一到七分的评分。法院文件指控该公司在未事先明确告知用户的情况下,将真实用户对话转交给外部审阅人员。
根据诉状,受聘担任"AI数据审阅员"和"聊天机器人评估员"等角色的承包商会阅读真实的ChatGPT提示和完整对话,总结用户想要完成的内容,然后对四种不同的模型回答进行评分和点评,评分范围为1至7分。
这一流程是ChatGPT等聊天机器人得以改进的基本方式。人类对AI的回答进行评分,这些评分被反馈到训练中,使模型学会人们更偏好哪些回答——这种技术在业内称为基于人类反馈的强化学习(RLHF)。诉讼的核心指控是,OpenAI从未明确告知用户,阅读其对话的可能是真人,而不仅仅是机器。由于RLHF是整个行业广泛依赖的技术,这场争议的焦点不在于聊天机器人如何训练,而在于公司必须以多清晰的方式披露用户对话可能被真人查看。
OpenAI确实会在任何真人查看对话之前,先通过自动化系统进行处理。但诉状指控该过滤器并不总能拦截所有内容,这意味着个人详细信息有时仍会到达承包商手中。
Project Lily项目最早由媒体404 Media于9月14日曝光。据其报道,审阅人员在一个仪表板上工作,其中包含用户记忆摘要"——对一个人过往对话的回顾,即使用户名已被删除,仍可能泄露其大致位置、职业或个人生活等详细信息。
OpenAI表示,这些审阅旨在遏制两种特定行为:聊天机器人表现得过于像人类,以及聊天机器人过于迎合——研究人员将这种特质称为"谄媚"(sycophancy),即AI告诉用户其认为对方想听的内容,而非准确的信息。
ChatGPT拥有超过9亿周活跃用户,其中许多人把它当作日记本、心理治疗师,或只有自己能看到的搜索引擎。人们会输入健康症状、分手短信、税务问题以及法律纠纷。诉讼指出,OpenAI的隐私政策列出了可获得用户数据访问权限的部分外部方类别,但从未明确将数据标注或人工评估供应商列入其中。
诉状包含八项独立的法律指控,包括违反加州《不正当竞争法》和《消费者隐私法》,以及"侵扰幽居"等普通法指控——这是一种隐私侵权,涵盖以理性人会认为冒犯的方式窥探他人私人事务的行为。原告正在寻求损害赔偿、返还及惩罚性赔偿。
原告要求的强制令十分具体。他们希望OpenAI在任何对话转交给外部审阅人员之前必须获得用户主动同意,将"为所有人改进模型"设置默认关闭而非默认开启,在聊天窗口内添加清晰警告,并可能删除与被审阅对话相关的工作成果,同时重新训练任何使用了这些数据的模型。该开关目前确实存在,但默认为开启状态——因此希望将自己的对话排除在此类审阅之外的用户,目前必须自行找到并关闭该设置。
由于本案目前仍是拟议集体诉讼,它必须先通过集体认证,才能代表更广泛的用户群体继续推进。OpenAI须在10月13日前作出回应。