Суть проекта: человеческий фактор в обучении ИИ
Согласно расследованию 404 Media, компания OpenAI использует программу под кодовым названием Project Lilly для улучшения качества ответов ChatGPT. В рамках этого проекта нанимаются сотни подрядчиков, называемых «проверяющими запросы» (prompt reviewers). Их задача — вручную оценивать качество ответов модели по ряду параметров: отсутствие «AI-speak», снисходительного тона, эмодзи, сиренничества и антропоморфизма.
Критерии оценки жесткие: ИИ не должен имитировать личный опыт (например, фразы вроде «как шеф-повар, я люблю...» запрещены). Однако работа описывается самими операторами как «очень рутинная», несмотря на высокую ставку оплаты.
Проблема конфиденциальности и «User Memories»
Главная проблема заключается в том, что пользователи часто не осознают, что их переписку читают живые люди. Многие используют ChatGPT как психолога или друга, доверяя боту глубокие секреты. Хотя чаты проходят процесс анонимизации, OpenAI признала, что фильтрация может пропускать персональные данные, особенно в коротких диалогах.
В распоряжение проверяющих попадает не только текст, но и «User Memories Summary» — сводка вопросов, интересов, контекста и потенциально даже геолокации пользователя. Фактическая точность ответов при этом не оценивается (за исключением очевидных ошибок), так как этим занимаются другие команды.
Почему это важно для пользователей
Настройка «Разрешить использование чатов для улучшения продукта» включена по умолчанию для большинства пользователей, включая платные тарифы (за исключением Enterprise, Business и Educational). Важно понимать:
- Настройка не работает задним числом: старые чаты остаются в базе.
- Удаление чата не гарантирует его исчезновение из обучающих датасетов, если он уже был обработан.
- Информация о человеческом обзоре в FAQ OpenAI появилась более двух лет назад, но после расследования страница была обновлена, хотя упоминание операторов-людей из текста убрали.
Сравнение с конкурентами
Практика ручного обзора чатов стала отраслевым стандартом. Google Gemini прямо указывает в Privacy Hub, что «люди могут просматривать некоторые сохраненные чаты». Anthropic также имеет отдельную страницу, посвященную этой теме. Perplexity AI в своем уведомлении о конфиденциальности не подтверждает и не опровергает доступ людей к логам.
| Платформа | Политика человеческого обзора | Нюансы |
|---|---|---|
| OpenAI (ChatGPT) | Да, Project Lilly | Подрядчики оценивают тон и стиль. Анонимизация не всегда надежна. По умолчанию сбор данных включен. |
| Google (Gemini) | Да | Прямое указание в Privacy Hub о возможности обзора сохраненных чатов людьми. |
| Anthropic | Да | Существует отдельная страница с описанием процесса обзора данных. |
| Perplexity AI | Неясно | Privacy Notice не подтверждает и не отрицает доступ людей к логам. |
Вывод
Существование Project Lilly доказывает, что современные ИИ-модели не совершенствуются исключительно за счет алгоритмов и больших наборов данных. Им по-прежнему требуется значительное количество квалифицированных людей для тонкой настройки. Для пользователей это означает, что конфиденциальность в чат-ботах остается иллюзией, если не отключать сбор данных вручную.
Источник: Tom's Hardware ↗
