Содержание
OpenAI платила внешним подрядчикам за чтение реальных диалогов в ChatGPT: расследование 404 Media описывает сотни ревьюеров, которые анализировали переписки пользователей для обучения модели.
Для многих это неприятный, но полезный холодный душ. Окно чат-бота выглядит как личный блокнот. Люди несут туда рабочие черновики, код, семейные истории и тревожные мысли. Но внутри сервиса часть таких диалогов может попасть не только в автоматическую обработку.
Project Lily: зачем людям давали читать диалоги ChatGPT
Внутреннюю программу OpenAI, по данным 404 Media, называли Project Lily. Подрядчики через сторонние кадровые компании получали больше $50 в час — около 4 000 рублей — и вручную оценивали ответы ChatGPT.
Схема выглядела не как модерация форума, а как тонкая настройка поведения модели. Ревьюер видел запрос пользователя, кратко описывал намерение и оценивал четыре варианта ответа по шкале от 1 до 7.
- Убирать AI-speak: штрафовать лишние галочки, приманки для вовлечения и перегруженное форматирование.
- Не очеловечивать бота: ChatGPT не должен приписывать себе человеческий опыт, например фразу «я как шеф-повар».
- Снижать подхалимство: отмечать ответы, где бот чрезмерно хвалит пользователя или усиливает личную злость.
Последний пункт особенно важен для безопасности. У ChatGPT уже были претензии из-за ответов, которые слишком активно соглашались с пользователем. Для живого собеседника это выглядит дружелюбно. Для ИИ-сервиса это риск, особенно в чувствительных темах.
Анонимность не спасает, если в тексте есть личные детали
OpenAI заявляет, что не передает ревьюерам имена аккаунтов, а диалоги проходят через автоматический Privacy Filter. Компания сама признает, что фильтр может ошибаться: он пропускает редкие идентификаторы и неоднозначный личный контекст.
404 Media пишет, что интерфейс подрядчиков иногда показывал блок с краткой сводкой пользовательских «воспоминаний». Такой блок мог раскрыть город, профессию, привычки или детали личной жизни без прямого имени и фамилии.
И это ключевая проблема. Настоящая приватность ломается не только паспортными данными. Достаточно связки из должности, района, семейного статуса и пары рабочих проектов. Для знакомого человека такой набор уже почти подпись.
OpenAI отдельно описывала свой фильтр в заметке о Privacy Filter. Но даже хороший автоматический редактирующий слой не превращает личный дневник в безопасный набор обезличенных строк.

OpenAI не одна: рынок ИИ давно работает с людьми в контуре
Человеческая проверка не уникальна для OpenAI. Anthropic подтверждает, что использует ревьюеров для Claude, если пользователь оставил обучение на своих данных включенным. У Google Gemini есть предупреждение, что люди читают часть сохраненных чатов.
Разница для пользователя часто не в самой практике, а в ощущении контроля. Соцсети приучили нас к публичности. Чат-бот, наоборот, открывается чистым пустым окном и звучит почти как личный собеседник.
В расследовании 404 Media встречались запросы, где люди прямо просили ChatGPT «оставить это между нами». Такая фраза не меняет настройки сервиса. Модель может ответить сочувственно, но серверная обработка живет по правилам платформы.
Для личных аккаунтов Free, Plus и Pro улучшение модели включено по умолчанию. У Enterprise, Business и Edu OpenAI отключает такую передачу данных автоматически.
Пользователь может выключить пункт «Improve the model for everyone» в настройках Data Controls. Но этот отказ не действует задним числом: уже обезличенные и поставленные в очередь диалоги остаются в цикле обучения, а автоматические проверки на нарушения правил сервиса продолжают работать.