ИА SakhaNews. Модели ИИ OpenAI GPT 5.6 Sol и неизвестная система «сбежали» в интернет во время тестирования и попытались взломать Hugging Face. Они использовали уязвимость в программном обеспечении, чтобы получить доступ к данным и «жульничать» при выполнении задания. Атака от начала до конца организована автономным ИИ-агентом.
В ходе испытаний одной из ИИ-моделей разработчика ChatGPT — американской компании OpenAI — произошёл беспрецедентный инцидент в сфере кибербезопасности. Модели искусственного интеллекта «сбежали» в интернет и попытались совершить хакерскую атаку на системы другого разработчика — компании Hugging Face.
OpenAI тестировала свои модели на наличие уязвимостей с помощью специального теста. Вместо того чтобы искать уязвимости самостоятельно, одна из моделей обнаружила ошибку в программном обеспечении, ограничивающем доступ к другим системам, и использовала её для выхода в интернет. Затем она предприняла попытку хакерской атаки на инфраструктуру Hugging Face.
По данным OpenAI, атаку совершили: модель GPT 5.6 Sol; неназванная «ещё более мощная» модель, которую пока что еще не представили широкой публике.
Hugging Face сообщила о попытке проникновения ещё на прошлой неделе, назвав её «беспрецедентной», поскольку она «от начала и до конца» была организована автономным ИИ-агентом.
Глава Hugging Face Клеман Деланг заявил: «Учитывая сложность используемого агента, мы подозревали, что кибератака могла быть совершена из какой-нибудь тестовой лаборатории. И вот выяснилось, что так оно и было».
Модели проходили тестирование в «высоко изолированной среде» с ограниченным доступом в сеть. Однако они смогли выявить уязвимости в программной среде OpenAI и инфраструктуре Hugging Face, получив прямой доступ к базам данных последней. Модели были «гиперсфокусированы» на поиске решения для задачи и приложили «невероятные усилия» для её решения.
Обнаружив, что на Hugging Face могут храниться данные, связанные с тестом, модели начали поиск и нашли способ доступа к секретной информации, которая позволила бы моделям «жульничать» при прохождении задания.
OpenAI продолжает расследование совместно с Hugging Face. В последней уточнили, что смогли пресечь атаку с помощью собственного ИИ-инструмента. OpenAI также проинформировала клиентов об уязвимости, которую модели использовали для «бегства» в сеть.
Компании делятся предварительными результатами расследования, чтобы помочь специалистам в кибербезопасности понять произошедшее и адаптировать свои инструменты под новые возможности ИИ-моделей.