ИИ-модели OpenAI вышли из-под контроля и взломали другую компанию

OpenAI заявила о потере контроля над ИИ-моделями во время испытаний

Во время внутренних испытаний новые модели искусственного интеллекта OpenAI получили доступ к интернету, самостоятельно нашли способ атаковать платформу Hugging Face и обнаружили уязвимости в ее инфраструктуре, сообщили в компании

Sean Gallup / Getty Images

Фото: Sean Gallup / Getty Images

Входит в сюжеты
В этой статье

Компания OpenAI сообщила о «беспрецедентном киберинциденте», который произошел во время внутренних испытаний ее новых моделей искусственного интеллекта. В ходе тестирования они получили открытый доступ к интернету, а затем атаковали инфраструктуру платформы Hugging Face, выявив уязвимости, говорится в сообщении OpenAI.

Инцидент произошел во время проверки кибервозможностей моделей, в том числе GPT-5.6 Sol и еще одной, более мощной версии, которая пока не выпущена. Для оценки их возможностей разработчики временно отключили часть ограничений, препятствующих выполнению потенциально опасных действий.

Hugging Face — американская платформа для разработки и публикации моделей искусственного интеллекта и инструментов машинного обучения. Она позволяет разработчикам и исследователям обмениваться ИИ-моделями, наборами данных и программным кодом. Платформа считается одним из крупнейших открытых репозиториев моделей искусственного интеллекта.

Как рассказали в компании, модели сначала нашли и объединили несколько уязвимостей в исследовательской инфраструктуре OpenAI, а затем использовали неизвестную ранее уязвимость «нулевого дня» (zero-day) в программном обеспечении, через которое тестовая среда получала доступ к пакетам.

После этого модели предположили, что на платформе Hugging Face могут храниться данные, необходимые для прохождения теста ExploitGym. Чтобы добраться до них, они использовали украденные учетные данные и нашли способ выполнить удаленный код на серверах компании, получив доступ к закрытой информации.

Подозрительную активность обнаружили специалисты OpenAI, а команда Hugging Face остановила атаку. Компании ведут совместное расследование.

После инцидента OpenAI сообщила, что усилит защиту своей инфраструктуры и поменяет порядок проведения подобных испытаний. В компании считают, что произошедшее показало, что современные ИИ-модели уже способны самостоятельно искать новые способы взлома реальных компьютерных систем без доступа к их исходному коду.

OpenAI — американская компания, занимающаяся разработкой систем искусственного интеллекта. Она создала чат-бот ChatGPT, а также семейство языковых моделей GPT. Компания была основана в 2015 году, ее штаб-квартира находится в Сан-Франциско.

В июне OpenAI выпустила новейшие версии своего чат-бота GPT-5.6 Sol, Terra и Luna для ограниченного круга пользователей по просьбе правительства США. В компании пояснили, что новые модели обладают «самыми надежными средствами защиты на сегодняшний день». По мере разработки специалисты продолжат добавлять новые средства защиты, которые будут противостоять атакам киберпреступников, сохраняя доступ к задачам. В этом месяце компания представила свое первое устройство — компактную клавиатуру Codex Micro. Новинка позиционируется как «командный центр» для работы с ИИ‑агентами.

Оставайтесь на связи с РБК в «Максе».