Иск утверждает, что OpenAI позволила внешним подрядчикам читать переписку пользователей с ChatGPT
Ключевые выводы
- •Два пользователя из Калифорнии подали предварительный коллективный иск против OpenAI, утверждая, что внешние подрядчики читали реальные диалоги ChatGPT без достаточного раскрытия информации пользователям.
- •Иск касается Project Lily — программы, в рамках которой подрядчики обобщают запросы пользователей и оценивают ответы чат-бота по шкале от одного до семи в рамках обучения с подкреплением на основе обратной связи от человека.
- •Согласно иску, автоматический фильтр OpenAI не удаляет лич данные, а панели рецензентов включали «user memories summary», которая могла раскрывать местоположение, профессию или личную жизнь человека.
- •OpenAI заявляет, что проверки направлены на сокращение слишком человекоподобного или чрезмерно услужливого поведения чат-бота — черты, известной как «sycophancy» (угодничество).
- •Истцы требуют возмещения ущерба, реституцию и штрафные убытки по восьми пунктам, а также судебный запрет, обязывающий получать согласие opt-in, отключать передачу данных по умолчанию и добавлять предупреждения в чате; ответ OpenAI должен быть представлен до 13 октября.

Два пользователя ChatGPT из Калифорнии подали против OpenAI предварительный коллективный иск, утверждая, что компания позволила внешним подрядчикам читать реальные диалоги пользователей без надлежащего раскрытия информации. Иск был подан в этом месяце в Окружной суд США по Северному округу Калифорнии. OpenAI вручили иск 2 сентября, и у компании есть время до 13 октября, чтобы ответить в суде.
Иск касается «Project Lily» — внутренней программы OpenAI, в рамках которой подрядчики, нанятые через сторонние кадровые агентства, обобщают запросы пользователей и оценивают ответы чат-бота по шкале от одного до семи. В исковом заявлении компанию обвиняют в передаче реальных пользовательских чатов внешним рецензентам без явного предварительного уведомления пользователей.
Согласно иску, подрядчики на таких ролях, как «AI data reviewer» и «chatbot evaluator», читают реальные запросы к ChatGPT и полные диалоги, обобщают, чего пытался добиться пользователь, а затем оценивают и критикуют четыре разных ответа модели по шкале от одного до семи.
Этот процесс — базовая версия того, как чат-боты вроде ChatGPT на самом деле улучшаются. Люди оценивают ответы ИИ, и эти оценки возвращаются в обучение, чтобы модель понимала, какие ответы предпочитают люди, — метод, который в отрасли называют обучением с подкреплением на основе обратной связи от человека (RLHF). Основное утверждение иска состоит в том, что пользователям никогда явно не сообщали, что их чаты может читать человек, а не только машина. А поскольку RLHF — метод, на который опирается вся отрасль, суть спора меньше в том, как обучаются чат-боты, и больше в том, насколько явно компании обязаны раскрывать, пользовательские диалоги могут попасться на глаза людям.
OpenAI действительно пропускает диалоги через автоматическую систему до того, как их увидит человек. В иске утверждается, что этот фильтр не всегда улавливает всё, из-за чего личные данные всё же иногда попадают к подрядчикам.
О Project Lily впервые сообщило издание 404 Media 14 сентября. Согласно его расследованию, рецензенты работают через панель, включающую «user memories summary» — сводку прошлых диалогов человека, которая может раскрывать такие детали, как его примерное местоположение, профессия или личная жизнь, даже хотя имена пользователей удаляются.
OpenAI заявила, что цель проверок — сократить два конкретных поведения: слишком человекоподобное поведение чат-бота и его чрезмерную услужливость — черту, которую исследователи называют «sycophancy» (угодничество), когда ИИ говорит пользователю то, что, как ему кажется, тот хочет услышать, а не то, что соответствует действительности.
У ChatGPT более 900 миллионов недельных пользователей, многие из которых относятся к нему как к дневнику, психотерапевту или поисковику, видимому только им. Люди вводят симптомы болезней, тексты для расставания, вопросы о налогах и юридические проблемы. В иске утверждается, что политика конфиденциальности OpenAI называет некоторые категории внешних сторон, получающих доступ к данным пользователей, но никогда прямо не указывает среди них поставщиков услуг разметки данных или человеческой оценки.
Иск содержит восемь отдельных правовых требований, включая нарушения калифорнийских законов о недобросовестной конкуренции и о конфиденциальности потребителей, а также требований общего права, таких как «intrusion upon seclusion» — деликт о вторжении в частную жизнь, охватывающий вмешательство в личные дела человека способом, который разумный человек счёл бы оскорбительным. Истцы требуют возмещения ущерба, реституцию и штрафные убытки.
Требуемый судебный запрет конкретен. Истцы хотят, чтобы OpenAI требовала согласия по принципу opt-in до передачи любого диалога внешнему рецензенту, отключила настройку «Improve the model for everyone» по умолчанию вместо включённой, добавила явное предупреждение внутри самого окна чата и, возможно, удалила материалы, связанные с проверенными диалогами, переобучив все модели, которые их использовали. Этот переключатель уже существует, но по умолчанию включён — поэтому пользователям, желающим исключить свои чаты из подобных проверок, сейчас приходится самим находить и отключать его.
Поскольку иск пока является предварительным коллективным, он должен пройти сертификацию класса, прежде чем сможет двигаться дальше от имени более широкой группы пользователей. Ответ OpenAI должен быть представлен до 13 октября.