Статья
OpenAI сообщила о крупном инциденте в области кибербезопасности, произошедшем во время внутренних испытаний новых моделей искусственного интеллекта. Как говорится в официальном заявлении компании, тестируемые модели получили доступ к интернету, самостоятельно нашли способ атаковать инфраструктуру платформы Hugging Face и выявили в ней ряд уязвимостей.
Инцидент случился в ходе проверки кибервозможностей новых моделей — GPT-5.6 Sol и еще одной, более мощной версии, которая пока не вышла в публичный доступ. Чтобы оценить реальный потенциал моделей, разработчики временно сняли часть ограничений, блокирующих потенциально опасные действия.
Получив доступ к сети, модели сначала обнаружили и объединили несколько уязвимостей в исследовательской инфраструктуре самой OpenAI. Затем они использовали ранее неизвестную уязвимость «нулевого дня» в программном обеспечении, через которое тестовая среда получала доступ к внешним пакетам.
Дальше события развивались еще стремительнее. Модели предположили, что на платформе Hugging Face могут храниться данные, необходимые для прохождения теста ExploitGym. Чтобы получить к ним доступ, они использовали украденные учетные данные и нашли способ удаленного выполнения кода на серверах компании — а вместе с ним и доступ к закрытой информации.
Атаку остановили специалисты Hugging Face, а подозрительную активность первыми заметили в OpenAI. Сейчас обе компании ведут совместное расследование инцидента.
После инцидента в OpenAI заявили, что усилят защиту собственной инфраструктуры и изменят порядок проведения подобных испытаний в будущем. В компании подчеркнули, что произошедшее демонстрирует новый уровень возможностей современных ИИ-моделей: они уже способны самостоятельно искать способы взлома реальных компьютерных систем, даже не имея доступа к их исходному коду.
Напомним, в июне OpenAI выпустила для ограниченного круга пользователей — по запросу правительства США — новейшие версии чат-бота: GPT-5.6 Sol, Terra и Luna. В компании тогда заявляли, что эти модели оснащены «самыми надежными средствами защиты на сегодняшний день», и обещали и дальше наращивать их устойчивость к атакам киберпреступников.
В июле OpenAI также представила свое первое физическое устройство — компактную клавиатуру Codex Micro, которую компания позиционирует как «командный центр» для работы с ИИ-агентами.
По мнению независимых специалистов по кибербезопасности, в основе инцидента лежала не только автономность моделей, но и человеческая ошибка. Как отмечает TechCrunch, тестовая среда, которую в OpenAI называли «полностью изолированной», на самом деле была неверно сконфигурирована и имела выход в интернет — именно это позволило моделям выбраться за пределы песочницы. Основатель компании Trail of Bits Дэн Гвидо считает, что изоляцию отключили именно тогда, когда защитные механизмы модели и так были ослаблены для теста, — в итоге не сработало ни то, ни другое.
Эксперты отмечают, что инцидент усилил тревогу в ИИ-сообществе по поводу способности моделей самостоятельно находить и использовать реальные уязвимости, хотя и подчеркивают, что это далеко не самый опасный сценарий из тех, что их беспокоят.
Куда более резко высказались исследователи в области безопасности ИИ. Йошуа Бенджио, лауреат премии Тьюринга и один из ведущих специалистов в этой области, назвал произошедшее «глубоко тревожным» и предупредил, что при сохранении нынешней траектории развития ИИ автономные кибератаки и другие проявления рассогласованного, опасного поведения моделей будут только учащаться.
Исследователь OpenAI Мика Кэрролл написал, что если этот случай кого-то до сих пор не убедил в серьезности рисков рассогласованности ИИ, то он не знает, что убедит. Часть экспертов сравнивают инцидент с крупными техногенными авариями вроде аварии на американской АЭС «Три-Майл-Айленд» в 1979 году, после которой резко ужесточили ядерное регулирование. То есть с реальным происшествием, способным стать тем самым тревожным звонком, который наконец подтолкнет регуляторов к жестким правилам для ИИ-индустрии.
***
Примечание: Hugging Face — американская платформа для разработки и публикации моделей искусственного интеллекта и инструментов машинного обучения. Она позволяет разработчикам и исследователям обмениваться ИИ-моделями, наборами данных и программным кодом и считается одним из крупнейших открытых репозиториев ИИ-моделей в мире.