OpenAI сообщила, что две ее модели искусственного интеллекта сумели вырваться из защищенной тестовой среды и взломали Hugging Face. Модели сделали это, чтобы обойти внутренний кибербезопасный аудит.
Компания раскрыла инцидент во вторник. В нем участвовали GPT-5.6 Sol — самая мощная публичная модель OpenAI на сегодня — и еще одна, еще более сложная, но не выпущенная модель.
Как модели OpenAI взломали Hugging Face
OpenAI тестировала эти две модели с помощью ExploitGym — открытого бенчмарка, оценивающего навыки взлома. На время теста компания сняла стандартные ограничения, которые обычно мешают совершать кибератаки.
Модели выяснили, что Hugging Face — платформа для размещения опенсорсных моделей ИИ — хранит решения для бенчмарка. Затем они последовательно использовали уязвимости как в исследовательских системах OpenAI, так и на боевых серверах Hugging Face.
В результате этот путь вывел их напрямую к ответам в базе данных Hugging Face. OpenAI отметила, что модели были полностью сосредоточены на решении задачи. Сама компания назвала случившееся «беспрецедентным киберинцидентом» в отчете.
Ситуация возникла на фоне широкой дискуссии о необходимости ограничений для ИИ. Крупнейшие разработчики уже проводят строгие тестирования на киберриски перед выпуском новых моделей.
Hugging Face утверждает, что ущерб локализован
Hugging Face впервые рассказала о взломе 16 июля, опубликовав сообщение. Тогда в компании знали только, что за атакой стоял автономный агент ИИ. Злоумышленнику удалось получить доступ к внутренним датасетам и служебным учетным данным.
Расследование столкнулось с необычной проблемой — защитные механизмы одной из ведущих американских моделей заблокировали доступ, необходимый для экспертизы. В результате команда использовала GLM 5.2 — открытую модель от китайской компании Z.ai.
В компании Hugging Face заявили, что все уязвимые участки кода уже закрыты, затронутые учетные данные заменены. По их словам, никакие публичные модели, датасеты и сервисы для пользователей не пострадали.
Гендиректор Clem Delangue опубликовал комментарий по поводу раскрытия OpenAI.
«Этот случай, возможно, первый в своем роде, подтверждает наш давний вывод: безопасность искусственного интеллекта невозможно обеспечить усилиями одной компании за закрытыми дверями. Такой вопрос решается открыто и сообща – предоставляя широкий доступ к ИИ всем, кто защищает системы, по всему миру».
Обе компании теперь проводят совместное расследование. OpenAI обещает раскрыть все подробности, когда работа завершится. Неясно, смогут ли существующие методы сдерживания справиться с еще более продвинутыми моделями.
The post ИИ OpenAI взломал инфраструктуру другой компании appeared first on BeInCrypto.