Новости 3 мин чтения
OpenAI нанимает подрядчиков для чтения личных переписок пользователей ChatGPT
OpenAI привлекла сотни контрактников для анализа реальных диалогов пользователей ChatGPT, включая чувствительные данные. Проект получил кодовое название Project Lily, а оплата превышает 50 долларов в час.
Американская компания OpenAI набирает сотни подрядчиков, которые читают массивы реальных запросов пользователей ChatGPT, включая личную и чувствительную информацию. Об этом сообщило издание 404 Media со ссылкой на внутренние документы и беседы с рецензентами. По данным издания, контрактники получают доступ к целым перепискам между пользователями и чат-ботом, о чем большинство из более чем 900 миллионов пользователей сервиса, вероятно, не подозревает.
Задача этих команд — улучшать ответы ChatGPT: подрядчики оценивают и критикуют сгенерированные чат-ботом реплики. Как показывают внутренние документы, контрактников учат отучать ChatGPT от антропоморфизации себя и от избыточной угодливости. Эта проблема, как отмечается, отчасти привела к тому, что чрезмерно уступчивая модель 4o была связана, согласно ряду исковых заявлений, с несколькими случаями самоубийств пользователей. Проект получил внутреннее кодовое название Project Lily. Какую именно модель OpenAI тренирует таким образом, в материалах не указано.
Рецензенты не видят имена пользователей, а OpenAI заявила 404 Media, что пытается удалять личные данные до того, как запросы попадают к ним, — с помощью модели Privacy Filter. Однако в компании признают, что чувствительные детали иногда всё же проходят фильтрацию: по описанию самой OpenAI, модель может «пропускать нестандартные идентификаторы или неоднозначные упоминания приватной информации». По словам одного из рецензентов, с которым говорило издание, пользователи, скорее всего, не представляют, что их переписку анализирует «какой-то подрядчик».
Работу подрядчикам организует компания Mercor через рекрутинговую фирму Crossing Hurdles. По словам одного из рецензентов, живущего в Северной Америке, оплата превышает 50 долларов в час — заметно выше, чем в среднем платят за похожую работу по модерации контента в технологическом секторе.
Anthropic подтвердила 404 Media, что также применяет ревью реальных переписок людьми для улучшения своих моделей — но только у пользователей, включивших в настройках приватности опцию Help improve our AI models («Помогать улучшать наши модели»). При этом компания предварительно удаляет из диалогов идентификаторы аккаунта, включая email.
Ранее стало известно, что переписки пользователей с ChatGPT были доступны через поиск Google — поисковик индексировал чаты, которыми люди делились сами. После этого OpenAI отключила соответствующую функцию.



