ИИ-модели OpenAI вышли из-под контроля и взломали другую компанию
OpenAI заявила о потере контроля над ИИ-моделями во время испытаний
Во время внутренних испытаний новые модели искусственного интеллекта OpenAI получили доступ к интернету, самостоятельно нашли способ атаковать платформу Hugging Face и обнаружили уязвимости в ее инфраструктуре, сообщили в компании

Фото: Sean Gallup / Getty Images
Компания OpenAI сообщила о «беспрецедентном киберинциденте», который произошел во время внутренних испытаний ее новых моделей искусственного интеллекта. В ходе тестирования они получили открытый доступ к интернету, а затем атаковали инфраструктуру платформы Hugging Face, выявив уязвимости, говорится в сообщении OpenAI.
Инцидент произошел во время проверки кибервозможностей моделей, в том числе GPT-5.6 Sol и еще одной, более мощной версии, которая пока не выпущена. Для оценки их возможностей разработчики временно отключили часть ограничений, препятствующих выполнению потенциально опасных действий.
Hugging Face — американская платформа для разработки и публикации моделей искусственного интеллекта и инструментов машинного обучения. Она позволяет разработчикам и исследователям обмениваться ИИ-моделями, наборами данных и программным кодом. Платформа считается одним из крупнейших открытых репозиториев моделей искусственного интеллекта.
Как рассказали в компании, модели сначала нашли и объединили несколько уязвимостей в исследовательской инфраструктуре OpenAI, а затем использовали неизвестную ранее уязвимость «нулевого дня» (zero-day) в программном обеспечении, через которое тестовая среда получала доступ к пакетам.
После этого модели предположили, что на платформе Hugging Face могут храниться данные, необходимые для прохождения теста ExploitGym. Чтобы добраться до них, они использовали украденные учетные данные и нашли способ выполнить удаленный код на серверах компании, получив доступ к закрытой информации.
Подозрительную активность обнаружили специалисты OpenAI, а команда Hugging Face остановила атаку. Компании ведут совместное расследование.
После инцидента OpenAI сообщила, что усилит защиту своей инфраструктуры и поменяет порядок проведения подобных испытаний. В компании считают, что произошедшее показало, что современные ИИ-модели уже способны самостоятельно искать новые способы взлома реальных компьютерных систем без доступа к их исходному коду.
OpenAI — американская компания, занимающаяся разработкой систем искусственного интеллекта. Она создала чат-бот ChatGPT, а также семейство языковых моделей GPT. Компания была основана в 2015 году, ее штаб-квартира находится в Сан-Франциско.
В июне OpenAI выпустила новейшие версии своего чат-бота GPT-5.6 Sol, Terra и Luna для ограниченного круга пользователей по просьбе правительства США. В компании пояснили, что новые модели обладают «самыми надежными средствами защиты на сегодняшний день». По мере разработки специалисты продолжат добавлять новые средства защиты, которые будут противостоять атакам киберпреступников, сохраняя доступ к задачам. В этом месяце компания представила свое первое устройство — компактную клавиатуру Codex Micro. Новинка позиционируется как «командный центр» для работы с ИИ‑агентами.
Оставайтесь на связи с РБК в «Максе».

