OpenAI нанимает сотни подрядчиков, которые читают реальные диалоги пользователей ChatGPT, чтобы улучшать ответы чат-бота, сообщает расследование 404 Media. Проверяющие оценивают ответы по шкале от одного до семи и должны снижать избыточную лесть и слишком человеческое поведение в выдаче модели. Для компаний, которые используют ChatGPT как рабочий инструмент, это означает, что часть их переписки может проходить через людей, а не только через серверы.
Как устроен конвейер проверки
Издание получило утечку внутренних документов и поговорило с дополнительными источниками. Проверяемые запросы анонимизированы, но всё равно могут содержать чувствительные персональные данные. OpenAI применяет фильтр приватности и признаёт, что он может ошибаться. Один из проверяющих сказал 404 Media, что, по его мнению, пользователи не знали о том, что люди читают их чаты, и просмотренные запросы это подтверждают: в некоторых диалогах пользователи прямо просили ChatGPT сохранить содержание в тайне.
Набор идёт через Crossing Hurdles, которая описывает себя как компанию, соединяющую квалифицированных специалистов с будущим работы в сфере AI, а выплаты проходят через компанию по обучению AI Mercor. Один проверяющий из Северной Америки сказал, что зарабатывает более $50 в час. Сама задача не предполагает свободных комментариев: работники ставят ответам оценку по шкале от одного до семи и уводят модель от лести и чрезмерно человеческих формулировок, а это формирует то, как система отвечает платящим пользователям дальше.
Пользователи могут отключить настройку Improve the model for everyone, которая включена по умолчанию, чтобы их чаты не использовались для обучения модели и потенциально не читались людьми. Переключатель действует только на новые разговоры. OpenAI также предлагает режим временного чата, который, по заявлению компании, не использует входные данные для обучения модели. В сумме защита зависит от действий пользователя до начала разговора, а не после него.
Что это значит для бизнес-пользователей
Для компании, которая вставляет в ChatGPT договоры, переписку с клиентами или внутренние отчёты, практическое следствие — изменение периметра обработки данных: сотрудники вендора и его подрядчики становятся частью цепочки. Небольшая команда обычно не имеет политики на этот счёт и полагается на настройки по умолчанию, тогда как крупная компания с функцией безопасности чаще требует корпоративный договор, документированный список субпроцессоров и правило о том, какие данные нельзя вводить вообще.
Остаётся неясным, сколько диалогов реально проверяется, как долго они хранятся и как тестируется фильтр приватности. Само раскрытие информации находится на странице FAQ, где OpenAI указывает, что уполномоченный персонал и поставщики услуг могут просматривать данные пользователей для улучшения работы модели, и советует не вводить чувствительную информацию; это уведомление опубликовано как минимум с 2023 года и с тех пор менялось лишь немного. 404 Media считает формулировку слишком скрытой и расплывчатой, а название Improve the model for everyone читается скорее как дружеский вклад в сообщество, чем как согласие на то, чтобы люди читали переписку. На вопрос, где пользователям прямо сообщают о человеческой проверке, OpenAI сначала не ответила.
Обратная связь от людей остаётся ключевой частью улучшения моделей, и практика распространена. Anthropic подтвердила 404 Media, что использует проверяющих для оценки ответов Claude и улучшения будущих моделей — для пользователей, у которых в настройках приватности включено Help improve our AI models, причём перед проверкой из диалогов удаляются данные аккаунта, например адреса электронной почты. Google тоже использует проверяющих и отмечает в Gemini, что люди могут просматривать сохранённые чаты. Следить стоит за тем, перенесёт ли OpenAI уведомление о человеческой проверке из FAQ в сам процесс согласия: если доля отказов окажется высокой, отрасли придётся иначе оценивать такую обратную связь.
