Читайте нас в Telegram или Макс

Сотни подрядчиков OpenAI вручную читают переписки пользователей ChatGPT — 404 Media

OpenAI привлекла сотни сторонних подрядчиков, которые вручную читают и оценивают реальные переписки пользователей с ChatGPT, сообщает 404 Media.

По данным расследования, специалисты обучают языковые модели в рамках внутренней инициативы под кодовым названием Project Lily. Задача рецензентов — кратко сформулировать суть запроса человека и выставить баллы четырём сгенерированным ответам по шкале от одного до семи. Эксперты также отслеживают «сикофантию» (чрезмерную угодливость чат-бота), попытки очеловечивания и неуместные эмодзи.

GPT-6 не распознаёт запрещённые запросы в неверной раскладке
GPT-6 умеет понимать текст на неверной раскладке клавиатуры, но встроенные фильтры безопасности пока не умеют проверять его на нарушения.

Хотя в рабочем интерфейсе скрыты имена учётных записей, а текст предварительно проходит через алгоритм Privacy Filter, конфиденциальные данные всё равно доходят до людей. В OpenAI подтвердили, что фильтр может пропускать личную информацию. Более того, рецензентам часто виден блок воспоминаний пользователя (user memories), где указаны контекст его прошлых обращений и примерная геолокация.

Специалисты получают более $50 в час через сторонние компании вроде агентства Crossing Hurdles и платформы Mercor. В комментарии изданию компания Anthropic также признала, что привлекает людей для ручной проверки диалогов с моделью Claude.

В OpenAI уточнили, что отправку переписок можно заблокировать: для этого нужно вручную отключить параметр «Improve the model for everyone» в настройках ChatGPT. Пункт активен по умолчанию для тарифов Free, Plus и Pro, однако его деактивация защитит только новые диалоги и не затронет уже обработанные данные.

В ChatGPT нашли скрытый канал между аккаунтами, через который можно было читать чужую почту
Жертва отправляла обычный запрос, получала обычный ответ и не видела, что её сессия в это же время работала на постороннего.