Журналисты издания 404 Media выяснили, что сотни подрядчиков OpenAI читают промпты и переписки пользователей с ChatGPT, чтобы улучшать ответы моделей. Хотя перед использованием данные проходят анонимизацию, в таких диалогах всё равно сохраняются конфиденциальные и личные сведения.
Исследователи ознакомились с утекшими внутренними материалами OpenAI: инструкциями для проверяющих, перепиской в Slack, реальными пользовательскими промптами и системой оценок. В документах проект фигурирует под кодовым названием Project Lily. «Не думаю, что люди представляют себе, что какой-то подрядчик где-то анализирует их разговоры», — признался изданию один из проверяющих. Подрядчикам недоступны имена аккаунтов, но сами чаты порой содержат личную информацию, а вместе с запросом отображается сводка из памяти ChatGPT: для каких задач человек использует сервис, где живёт и другие подробности. Один из собеседников рассказал, что получает за такую работу больше 50 долларов в час, а нанимает подрядчиков компания Mercor через рекрутинговое агентство. Работа устроена так: человек читает реальный запрос пользователя, описывает, чего тот хотел, затем оценивает четыре варианта ответа модели по шкале от одного до семи баллов, отмечая удачные и неудачные фрагменты.
В OpenAI заявили, что все чаты перед передачей обрабатывает модель Privacy Filter, которая должна вычищать персональные данные. При этом в компании признают: фильтр работает неидеально — может пропустить редкие или необычно записанные данные, не распознать косвенные упоминания или, наоборот, скрыть лишнее. В компании подчёркивают, что чаты не используются, если в настройках отключена опция Improve the model for everyone, — но для бесплатных и базовых платных тарифов она включена по умолчанию, а её отключение касается только новых разговоров, не трогая уже существующие. Аналогичные практики подтвердили и в Anthropic, а Google прямо предупреждает, что сохранённые чаты Gemini могут просматривать люди.
Суть проблемы хорошо сформулировала эксперт Center for Democracy & Technology: интерфейс чат-бота создаёт ложное ощущение беседы с глазу на глаз, хотя содержимое могут прочитать посторонние.
Не вводите в чат-боты ничего, что не хотели бы показать незнакомому человеку: пароли, данные документов, медицинские подробности, рабочие секреты. Если пользуетесь ChatGPT, зайдите в настройки и отключите Improve the model for everyone, а старые чувствительные чаты удалите вместе с памятью. И помните: удалённый чат и выключенная настройка действуют только на будущие разговоры.
Источник: Xakep.ru со ссылкой на 404 Media, 15 сентября 2026