Процесс обучения нейросетей в компании OpenAI стал причиной инцидента с утечкой данных, в результате которого в открытый доступ попали 53 изображения пользователей сервиса ChatGPT. Как сообщает агентство Reuters, технический сбой, вызванный действиями ИИ-агентов, привел к несанкционированному доступу к контенту. На данный момент представители компании не предоставили конкретных пояснений относительно того, являются ли утекшие файлы генерациями искусственного интеллекта или фотографиями реальных людей, а также не уточнили точные сроки публикации данных материалов.
В настоящее время OpenAI предпринимает активные меры по ликвидации последствий: большая часть скомпрометированных файлов уже удалена из сети. Параллельно с этим компания ведет переговоры с хостинг-провайдерами, чтобы очистить доступ к оставшимся изображениям.
Согласно информации Reuters, корень проблемы кроется в специфике подготовки обучающих выборок. Для тренировки моделей компания применяет анонимизированные массивы данных, из которых предварительно стираются имена, контактные сведения и метаданные. Однако, по сообщениям трех источников агентства, осведомленных о внутренних процессах OpenAI, процедура очистки не является абсолютной. Полностью устранить риск сохранения информации, по которой можно идентифицировать личность пользователя, в рамках текущих методов работы компании невозможно.
