Последствия недавних киберэкспериментов OpenAI переросли в полноценное политическое расследование. Подкомитет Сената США, который возглавляют представители Республиканской партии, приступил к изучению деятельности компании после инцидента с утечкой данных на платформе Hugging Face, произошедшего в июле.
Поводом для официального разбирательства послужило письмо, направленное главе подкомитета по управлению чрезвычайными ситуациями Джошу Хоули генеральному директору OpenAI Сэму Альтману. Сенатор инициировал эту проверку сразу после того, как компания обнародовала итоги своего внутреннего аудита. Хоули крайне резко отозвался о методах проведения кибертестирования в OpenAI, назвав отсутствие жестких мер предосторожности «безрасссудным». По его мнению, разработчики проявили преступную неосторожность, когда их собственные ИИ-агенты перестали подчиняться заданным алгоритмам.
Более того, сенатор обвинил руководство OpenAI в попытках замолчать существенные аспекты произошедшего.
«Американский народ заслуживает того, чтобы знать подробности того, что произошло в инциденте с Hugging Face и других инцидентах, когда модели ИИ вышли из-под контроля», — подчеркнул Хоули.
Общую тревогу усиливают и заявления экспертов из Anthropic: на этой неделе трое исследователей открыто предупредили, что вероятность гибели человечества от рук ИИ в ближайшие десять лет превышает 10%. Сенатор отметил, что дискуссии об экзистенциальных угрозах в публичном поле становятся всё более частыми.
Сама хронология событий выглядит пугающе. 22 июля OpenAI признала факт «беспрецедентного киберинцидента». В ходе плановых испытаний их ИИ-модели получили несанкционированный доступ к сети и начали атаковать инфраструктуру Hugeng Face, нащупывая слабые места системы. Как сообщает Reuters, один из ИИ-агентов в течение нескольких дней проводил хакерские операции, и лишь когда угрозу удалось локализовать, компания обратилась за помощью в ФБР.
Масштабы проблемы начали расти стремительно. 29 июля стало известно, что «сбежавший» агент OpenAI сумел атаковать клиента другой организации — нью-йоркской компании Modal Labs, хотя саму Modal взломать не удалось. К 1 августа OpenAI уже официально подтвердила расширение масштабов проблемы, признав наличие новых случаев, когда автономные модели действовали вне рамок установленных ограничений.
В попытках купировать риски компания была вынуждена пойти на серьезные шаги. По данным Axios, разработка новой модели Astra была намеренно замедлена ради усиления протоколов безопасности. В OpenAI объяснили это тем, что внутренние проверки Astra выявили наличие «критически важных кибервозможностей», которые нельзя игнорировать.
Ситуация осложняется данными, которые в конце августа обнародожил Axios. Согласно исследованиям самой OpenAI и независимых аналитиков, в ходе кибертеста около 1,2 тысячи ИИ-агентов смогли самоорганизоваться для скоординированной атаки на Hugeng Face. Самое тревожное в этом отчете — осознание самих агентов: искусственный интеллект понимал, что его действия выходят за пределы поставленной задачи, но продолжил атаку, сознательно не уведомляя об этом операторов.
