«Проект Lily»: живые люди читают ваши переписки с ChatGPT
OpenAI нанимает сотни внешних подрядчиков, которые читают непрерывный поток реальных запросов пользователей ChatGPT — об этом сообщает издание 404 Media со ссылкой на утёкшие внутренние документы, инструкции, каналы в Slack и подлинные тексты запросов. Большинство из более чем 900 миллионов пользователей сервиса, судя по всему, не догадываются, что их беседы с чат-ботом может прочитать живой человек.
Цель этой работы — улучшить ответы ChatGPT. Рецензенты оценивают и критикуют сгенерированные реплики: в частности, их учат отучать модель приписывать себе человеческие черты и быть менее угодливой. Именно чрезмерная льстивость модели 4o, по данным ряда исков, отчасти способствовала нескольким самоубийствам.
Как устроена проверка
Подрядчик выбирает «задачу», видит реальный запрос пользователя, кратко пересказывает, что тот хотел получить, а затем оценивает четыре варианта ответа бота по шкале от единицы («непригодно») до семи («трудно улучшить»). Требуется выделить не менее трёх фрагментов, которые соответствуют или не соответствуют целевой модели, и объяснить почему. Внутренние документы приводят курьёзные примеры: скажем, смайлики-черепа неуместны в разговоре о смерти, а самолётики — в сводке о крушении. Избыток эмодзи и «ИИ-канцелярит» снижают оценку.
Приватность под вопросом
Подрядчики не видят имён пользователей, а OpenAI прогоняет переписки через собственную модель Privacy Filter, удаляющую персональные данные. Однако компания признаёт: фильтр ошибается и может пропустить редкие идентификаторы. Более того, над запросом иногда выводится «сводка воспоминаний» о пользователе — включая предполагаемое место проживания и другой личный контекст. Среди увиденных 404 Media запросов встречались и такие, где человек прямо просил бота сохранить сказанное в тайне.
OpenAI не ответила на вопрос, предупреждала ли она пользователей о чтении их переписок людьми. Отключить использование чатов для обучения можно, сняв галочку «улучшать модель для всех», но у бесплатных, Plus- и Pro-тарифов она включена по умолчанию и работает не задним числом.
Практика не уникальна: Anthropic подтвердила, что тоже привлекает людей к проверке (при включённой соответствующей настройке и после обезличивания), а дисклеймер Google Gemini прямо сообщает о просмотре части чатов.
Человек за ширмой
Один из рецензентов из Северной Америки рассказал, что получает более 50 долларов в час — необычно щедро для отрасли — через посредника Crossing Hurdles, а платит в итоге компания Mercor. Работу он назвал «монотонной», а инструкции — противоречивыми и постоянно меняющимися.
Профессор UCLA Сара Т. Робертс сравнила разоблачение с эпизодом из «Волшебника страны Оз», где за магией скрывается человек, дёргающий рычаги. По её словам, модели постоянно нуждаются в человеческом вмешательстве — но именно этот труд компании ценят и оплачивают меньше всего, и щедрая ставка, скорее всего, продержится недолго.
Источник: 404 Media
Комментарии
Войдите, чтобы комментировать.