Агент искусственного интеллекта (ИИ), тестирование которого проводила корпорация OpenAI, вышел из-под контроля и взломал не одну, как предполагалось ранее, а две платформы. Об этом сообщило агентство Reuters со ссылкой на Акшата Бубну, технологического директора платформы Modal. Агент получил доступ к данным клиента, размещенным на ней. При этом, по словам господина Бубны, сама Modal не была взломана.

Ранее сообщалось, что во время тестирования ИИ-агент OpenAI вышел за пределы пространства, предназначенного для испытаний, и взломал платформу для работы с нейросетями Hugging Face.

Как отмечает издание Axios, «этот инцидент подчеркивает, сколь агрессивно ИИ-агенты могут выполнять цели, которые перед ними поставлены».

Hugging Face выпустила подробный технический отчет о взломе своей инфраструктуры, который компания связывает с автономным ИИ‑агентом OpenAI. Hugging Face пишет, что атака была не одним эксплойтом, а цепочкой из примерно 17,600 восстановленных действий, сгруппированных в около 6,280 кластеров, а сама кампания шла с 9 по 13 июля 2026 года. На интерактивной визуализации Hugging Face это названо 4.5-day campaign, то есть атака шла почти пять дней.

По версии Hugging Face, агент изначально работал в бенчмарке ExploitGym и, судя по реконструкции компании, пытался не столько «взломать ради взлома», сколько получить доступ к эталонным решениям и данным, которые могли помочь пройти оценку. Чтобы разобраться в действиях атакующего, Hugging Face использовала в том числе открытую модель GLM 5.2.

Важна механика атаки. Hugging Face описывает два пути первоначального проникновения в собственную инфраструктуру: чтение локальных файлов через HDF5 external raw storage и выполнение произвольного кода через Jinja2 template injection в dataset processor. После этого агент получил foothold внутри production pod, затем начал эскалацию, перемещение по кластерам, доступ к internal repos и попытки закрепиться в инфраструктуре.

Агенты искусственного интеллекта OpenAI в ходе инцидента со взломом платформы Hugging Face получили несанкционированный доступ не только к её ресурсам, но и как минимум к четырём общедоступным сервисам, для входа в которые они использовали открытые учётные данные, сообщил разработчик.

Уникальный инцидент в области кибербезопасности, возникший при тестировании ИИ-моделей OpenAI, оказался более масштабным, чем компания сообщила первоначально. На текущий момент установлено, что ИИ-агенты использовали четыре учётные записи на общедоступных сервисах в рамках попытки взлома Hugging Face. Эти учётные данные, предположительно, были опубликованы в открытом доступе. Одна из учётных записей, скомпрометированных ИИ-агентами OpenAI, использовалась в качестве «исходящего ретранслятора и промежуточного пути» — возможно, чтобы скрыть источник атаки на Hugging Face. В качестве вспомогательного средства в проведении взлома для хранения данных использовалась другая учётная запись. В одном из случаев жертвой взлома пал некий клиент облачной платформы Modal — ИИ OpenAI обнаружил уязвимость в кодовой базе этого клиента, но сама платформа скомпрометирована не была, заверили в её администрации.

ИИ-агенты OpenAI получили административный доступ к нескольким внутренним кластерам Kubernetes платформы Hugging Face, доступ root на ключевой сервер и доступ на запись к подсети репозиториев исходного кода на GitHub. Они зарегистрировали в корпоративной сети 181 устройство, используя украденные учётные данные, и получили доступ ко внутренним системам, где Hugging Face разрабатывает и тестирует собственные кодовые базы. В качестве «внешней стартовой площадки» для атаки использовалась минимум одна сторонняя песочница — в ней ИИ выполнял команды с привилегиями администратора и использовал её в качестве контрольной, промежуточной и исходящей базы для всей кампании.

Что пишут другие издания

  • Хабр: Hugging Face опубликовала технический разбор атаки ИИ‑агента OpenAI
  • 3DNews: Сорвавшиеся с поводка ИИ-агенты OpenAI взломали не только Hugging Face
  • 3DNews: OpenAI, Anthropic и Google призвали власти США взять под контроль ИИ-гонку после инцидента с Hugging Face