訴訟指控 OpenAI 讓外部承包商閱讀使用者的 ChatGPT 對話
重點速覽
- •兩名加州使用者對 OpenAI 提出擬議集體訴訟,指控外部承包商在未向使用者充分揭露的情況下閱讀真實的 ChatGPT 對話。
- •訴狀核心圍繞 Project Lily,承包商在其中摘要使用者提示,並以一到七分的尺度為聊天機器人回答評分,作為人類回饋強化學習的一環。
- •根據訴訟,OpenAI 的自動過濾機制並未移除個人細節,審閱人員的儀表板包含「使用者記憶摘要」,可能透露一個人的所在地、職業或個人生活。
- •OpenAI 表示這些審閱旨在抑制聊天機器人過於像真人或過於附和的行為,後者被稱為「諂媚」(sycophancy)。
- •原告依八項主張尋求損害賠償、返還利益及懲罰性賠償,並要求取得事先同意、資料分享設定預設關閉以及聊天視窗內警告的令;OpenAI 須在10月13日前回應。

兩名來自加州的 ChatGPT 使用者對 OpenAI 提出擬議集體訴訟,指控該公司允許外部承包商在未適當揭露的情況下閱讀真實使用者對話。本案於本月在美国加州北區聯邦地區法院提起。OpenAI 於9月2日收到送達,須在10月13日前於法庭上回應。
訴狀核心圍繞「Project Lily」,這是 OpenAI 內部的一項計畫,透過第三方人力派遣公司聘用的承包商摘要使用者提示,並以一到七分的尺度為聊天機器人的回答評分。法院文件指控該公司在未明確事先告知使用者的情況下,將真實對話轉交給外部審閱人員。
根據訴狀,以「AI 資料審查員」及「聊天機器人評估員」等職位聘用的承包商會閱讀真實的 ChatGPT 提示與完整對話,摘要使用者想達成的目的,然後以一到七分的尺度為四個不同的模型回答進行評分與批評。
這個流程是 ChatGPT 等聊天機器人實際上如何進步的基本版本。人類為 AI 的回答評分,這些評分會回饋到訓練中,讓模型學習人們偏好哪些回答——業界稱此技術為人類回饋強化學習(RLHF)。訴訟的核心指控是,使用者從未被清楚告知,閱讀其對話的可能是真人,而不只是機器。由於 RLHF 是整個產業普遍依賴的技術,這場爭議的重點比較不在於聊天機器人如何訓練,而在於公司必須多清楚地揭露真人可能會看到使用者對話。
OpenAI 確實會在任何人看到對話之前,先將對話通過自動化系統處理。訴狀指控該過濾機制並不總能攔截所有內容,意味著個人細節有時仍會送達承包商手中。
Project Lily 最初由媒體 404 Media 於9月14日揭露。根據其報導,審閱人員使用一個儀表板工作,其中包含「使用者記憶摘要——即一個人過往對話的回顧,即使使用者名稱已被移除,仍可能透露其大致所在地、職業或個人生活等細節。
OpenAI 表示,這些審閱旨在抑制兩種特定行為:聊天機器人表現得過於像真人,以及過於附和——研究人員稱之為「諂媚」(sycophancy),即 AI 告訴使用者它認為對方想聽的話,而非準確的內容。
ChatGPT 擁有超過9億的每週活躍使用者,其中許多人把它當成日記、心理諮商師,或只有自己看得到的搜尋引擎。人們輸入健康症狀、分手訊息、稅務問題和法律糾紛。訴訟主張,OpenAI 的隱私政策列出了部分可存取使用者資料的外部第三方類別,但從未明確將資料標註或人工評估供應商列入其中。
訴狀包含八項獨立的法律主張,包括違反加州《不正當競爭法》及《消費者隱私法》,以及諸如「侵入私隱」(intrusion upon seclusion)等普通法主張——這是一種隱私侵權行為,涵蓋以理性人會認為冒犯的方式窺探他人私人事務。原告尋求損害賠償、返還利益及懲罰性賠償。
原告要求的禁令內容相當具體。他們要求 OpenAI 在任何對話送交外部審閱人員之前取得事先同意(opt-in consent)、將「為所有人改善模型」(Improve the model for everyone)設定由預設開啟改為預設關閉、在聊天視窗內加入明確警告,並可能刪除與被審閱對話相關的工作成果,同時重新訓練任何使用過這些資料的模型。該開關目前確實存在,但預設為開啟——因此希望其對話排除在此類審閱之外的使用者,目前必須自行找到並關閉該設定。
由於本案仍是擬議集體訴訟,必須通過集體訴訟認證,才能代表更廣大的使用者群體推進。OpenAI 須在10月13日前提出回應。