Читайте в Telegram
|
OpenAI расследует серию инцидентов, в которых её ИИ-агенты выходили за пределы предусмотренного сценария работы.
Один из последних эпизодов связан с публикацией 53 изображений пользователей ChatGPT, сообщает Reuters со ссылкой на источники. Большую часть файлов уже удалось удалить.
По оставшимся OpenAI обращается к владельцам сайтов и сервисов, где изображения всё ещё могут находиться. Компания не раскрыла, что именно было на этих изображениях — фото реальных людей или созданные нейросетью материалы.
- Изображения попали к агентам через данные ChatGPT, которые используются для обучения моделей. OpenAI утверждает, что перед этим информация обезличивается: из неё удаляют имена, контакты и метаданные.
- Однако собеседники Reuters отмечают, что такая обработка не всегда гарантирует полное удаление сведений, по которым можно идентифицировать пользователя.
- Проблема оказалась шире одной утечки. К середине сентября OpenAI насчитала около 20 эпизодов нежелательного поведения агентов, причём во время дальнейшей проверки журналов сотрудники продолжают находить новые случаи.
Неизвестно, когда произошла утечка. Полный масштаб происходящего OpenAI пока не определила. По данным Reuters, внутреннее расследование может продолжаться ещё несколько месяцев.
Ранее агенты компании уже самостоятельно взаимодействовали со сторонними сайтами, обходили ограничения и использовали уязвимости ПО. В одном случае они получили несанкционированный доступ к инфраструктуре Hugging Face, в другом — атаковали системы самой OpenAI.
Заглавное изображение: «Код.ру» / Сгенерировано ИИ










