OpenAI наняла сотни подрядчиков для чтения реальных переписок пользователей ChatGPT

Компания OpenAI привлекла сотни внешних подрядчиков для чтения реальных переписок пользователей ChatGPT. Об этом сообщило издание 404 Media, получившее доступ к внутренним материалам проекта под кодовым названием Project Lily: инструкциям для рецензентов, перепискам в Slack, системе оценки ответов и самим обращениям пользователей.
Подрядчики анализировали диалоги, пересказывая намерения человека и оценивая реакции чат-бота, чтобы повысить качество ответов ChatGPT. Они работали не с отдельными сообщениями, а с целыми беседами, некоторые из которых содержали чувствительные личные данные. Один из сотрудников, участвовавших в разборе запросов, признался, что пользователи вряд ли догадываются о том, что их разговоры читают посторонние.
Этот процесс отличается от ранее публично описанных проверок: OpenAI открыто сообщала о просмотре чатов при подозрении на подготовку нападения, однако Project Lily является отдельной программой.
Проверка происходила через специальную панель, где рецензент выбирал задачу, после чего система открывала реальный запрос пользователя. Затем он выполнял три шага: читал запрос, кратко описывал намерение пользователя и оценивал несколько сгенерированных ответов. Например, пользователь просил помочь переписать рабочее сообщение в Slack так, чтобы оно звучало доброжелательно и приглашало к обсуждению. Подрядчик просматривал четыре варианта ответа ChatGPT, отмечал фрагменты, соответствующие или не соответствующие требованиям, выделял минимум три фрагмента и объяснял выбор. В конце ответ оценивался по шкале от 1 до 7: единица означала непригодность, семерка — близость к идеалу. Даже содержательно полезный ответ мог получить низкий балл за чрезмерную длину или перегруженность. Обоснование занимало от пары предложений до целого абзаца.
В документах не указано, какая именно модель обучалась и идет ли речь о текущей или будущей версии.
Руководства описывали требования к ответам: модель должна улавливать намерение пользователя, давать точную и полезную помощь, излагать мысли ясно, естественно и умеренно тепло. Другой конфиденциальный документ предписывал подстраиваться под тон пользователя, но сдержанно, оставаясь естественным и профессиональным, не намекая на человеческие эмоции. Рецензенты должны были отмечать угодливость, наигранное подражание стилю, вовлекающие концовки, подогрев раздражения и снисходительные допущения. Вместо этого ответ должен был быть полезным, честным, поддерживающим и умным, но без превосходства.
Отдельно боролись с «ИИ-речью» и неуместными эмодзи. Например, список с галочками в инструкции помечался как несоответствующий из-за ненужного использования эмодзи. Контекст учитывался: дерево в тексте про День дерева считалось уместным, а черепа в разговоре о смерти или самолеты в сводке об авиакатастрофе — нет. Ответы не должны были ссылаться на личный опыт вроде «как повар, я люблю…» или «я знаю, каково это», хотя первое лицо в служебных фразах типа «я посмотрю» допускалось.
Фактчекинг в задачи рецензентов не входил: искать подтверждения во внешних источниках не требовалось, проверкой контента занимались другие команды. Замеченные фактические ошибки помечались, а за отсутствие ссылок в ответах на медицинские, юридические и финансовые темы оценку снижали.
Запросы поступали обезличенными — имя аккаунта не отображалось, но личные данные все равно попадали в поле зрения. Иногда над обращением выводился блок «сводка памяти о пользователе», из которого можно было узнать, для чего человек раньше использовал чат-бот, где живет и другие обстоятельства. Инструкция требовала эскалировать задачи при обнаружении персональных данных или рисков для безопасности.
OpenAI заявила, что переписки проходят через модель Privacy Filter, предназначенную для поиска и удаления личной информации. Однако компания признала ограничения этой модели: фильтр ошибается, пропускает редкие идентификаторы и неоднозначные упоминания, а при коротких фрагментах может удалять данные избыточно или недостаточно. Некоторые просмотренные журналистами обращения показывали, что пользователи ожидали конфиденциальности и просили ChatGPT никому не рассказывать о сказанном.
Журналисты спросили OpenAI, предупреждали ли они пользователей о том, что запросы могут читать люди для улучшения ответов, но ответа не получили. На сайте компании описан просмотр помеченного контента людьми, но речь идет о нарушениях правил и угрозах безопасности. Политика конфиденциальности допускает использование персональных данных для улучшения моделей. Удаленные переписки компания обещала стирать за 30 дней, кроме уже обезличенных и отвязанных от аккаунта в рамках согласия на улучшение моделей. После публикации материала OpenAI указала на раздел справки, где говорится, что люди могут просматривать контент для улучшения работы модели.
Переписки попадают в обучение через настройку «улучшить модель для всех». На тарифах Free, Plus и Pro она включена по умолчанию, и отключать ее пользователь должен сам. Отключение действует только на новые диалоги, на тарифах Enterprise, Business и Edu настройка изначально выключена. После обращения журналистов компания обновила справочную страницу, подробнее описав процедуру отказа, но признания в том, что запросы читают люди, там по-прежнему нет.
Один из собеседников 404 Media из Северной Америки получал за чтение переписок более $50 в час. Работу он нашел через рекрутинговую фирму Crossing Hurdles, которая позиционирует себя как посредника между специалистами и заказчиками в сфере обучения ИИ. На Reddit несколько человек сообщали, что получали от этой фирмы нежелательные письма и подозревали мошенничество. На странице фирмы в LinkedIn были открыты вакансии рецензента ИИ-данных, разметчика и оценщика чат-ботов, хотя OpenAI и ChatGPT в описаниях не упоминались. В обязанности входила оценка ответов ИИ и их сравнение. Среди других проектов компании — запись видео, где исполнители выполняют работу по дому, для обучения роботов.
Рецензент описал работу как механическую, иногда забавную при чтении запросов, но в проекте царит разнобой: правила часто меняются и противоречат сами себе.
Anthropic подтвердила, что тоже прибегает к проверке людьми для улучшения моделей, включая будущие ответы Claude, для пользователей, включивших настройку «помогите улучшить наши ИИ-модели». Перед проверкой компания обезличивает переписки и удаляет идентификаторы аккаунта, включая адреса электронной почты. У Google Gemini есть дисклеймер о том, что часть сохраненных чатов просматривают люди.
Старший научный сотрудник Center for Democracy & Technology Михаль Лурия отметила, что проверка людьми необходима для безопасности, но текущие интерфейсы чат-ботов создают ложное чувство близости и приватности. Это принципиально отличается от модерации в соцсетях, где публикация контента изначально предполагает проверку и публичность. Профессор UCLA Сара Т. Робертс, автор книги о модерации контента, сравнила раскрытие с сюжетом «Волшебника страны Оз», где герои обнаруживают за волшебным королевством человека, дергающего за рычаги, подчеркнув, что такие системы требуют постоянного вмешательства людей. Почасовая ставка выше $50 заметно превышает оплату модераторов соцсетей и работников ИИ-разметки, которых часто нанимают за рубежом. Робертс предположила, что так платят лишь до поры, поскольку именно человеческий труд, без которого продукты не работают, оплачивается хуже всего и ценится меньше всего.
В апреле 2026 года OpenAI выпустила Privacy Filter — бесплатный инструмент на 1,5 млрд параметров, который вычищает конфиденциальные данные из переписки с ChatGPT.





