404 Media опубликовало внутренние материалы, описывающие программу OpenAI под кодовым названием Project Lily, в рамках которой сотни внешних подрядчиков читают реальные переписки людей с ChatGPT.
Чем занимаются рецензенты
Подрядчики кратко излагают, чего пытался добиться пользователь, а затем оценивают ответ модели по шкале от 1 до 7. Они отмечают конкретные типы недочётов, включая механическую фразировку и чрезмерное согласие с пользователем. Материал основан на инструкциях для рецензентов, сообщениях в Slack, критериях оценки и самих пользовательских переписках.
Оплата превышает $50 в час и проходит через компании-посредники, а не напрямую от OpenAI. Некоторые из рассмотренных переписок содержали чувствительную личную информацию.
Пробел в согласии
Одного из источников, работавших над программой, спросили, понимают ли пользователи, что их переписки таким образом просматриваются. Ответ был отрицательным: люди не представляют, что где-то есть подрядчик, анализирующий их разговор.
После публикации OpenAI сослалась на справочную страницу, где говорится, что люди могут просматривать контент для улучшения работы модели. Соответствующая настройка, которая направляет переписки на обучение, по умолчанию включена в тарифах Free, Plus и Pro. Отключить её — обязанность пользователя, и для этого нужно знать о её существовании.
Почему это важно
Проверка человеком сама по себе не скандал. Именно так эти системы приучают звучать менее механически, и в той или иной форме это делает каждый крупный ассистент. Материал же обнажает разрыв между оправданной практикой и тем, что пользователи на самом деле о ней понимают.
Практическое следствие узкое и конкретное. Если вы вставляете в универсального ассистента что-то, что не доверили бы незнакомцу — данные клиентов, медицинские сведения, ещё не опубликованную работу, — настройки по умолчанию не на вашей стороне. Проверьте переключатель, отвечающий за использование данных для обучения, либо выбирайте тариф и продукт, где обработка данных регулируется договором, а не является опциональной.