Целеустремленный ИИ.
16 июля Hugging Face, платформа для тестирования ИИ, сообщила о необычной кибератаке на инфраструктуру. В ходе нее автономная система ИИ-агентов получила доступ к ограниченному набору внутренних датасетов и нескольким учетным данным, которые использовались сервисами компании.
21 июля OpenAI раскрыла, что за взломом стоял агент на базе двух ее передовых моделей – GPT-5.6 Sol и еще одной, более мощной системы, которую разработчики пока не показали публично. Во время внутреннего эксперимента агент вышел за пределы тестовой среды и проник в инфраструктуру Hugging Face.
OpenAI проверяла киберспособности моделей на публичном бенчмарке ExploitGym. ИИ-агентам предлагалось решать сложные задачи по поиску и эксплуатации уязвимостей, а стандартные защитные механизмы, которые не позволяли моделям выполнять опасные действия, на время испытаний намеренно отключили.
Как модели выбрались из «песочницы»?
Тесты проходили в изолированной среде с жестко ограниченным сетевым доступом. Прямого подключения к интернету у агентов не было, однако они могли загружать необходимые программные пакеты через внутренний прокси-сервис.
Агенты обнаружили в нем ранее неизвестную уязвимость нулевого дня и использовали ее для выхода за пределы тестового контура. Затем они повысили свои привилегии и начали перемещаться по внутренней сети OpenAI, пока не добрались до системы с доступом в открытый интернет.

Почему целью стала Hugging Face?
Получив доступ к интернету, агенты предположили, что на Hugging Face могут храниться модели, датасеты и готовые решения для ExploitGym. После этого они начали искать способ добыть закрытую информацию и в итоге извлекли ответы на тестовые задания из базы данных платформы.
В ходе атаки агенты объединили несколько методов, включая использование похищенных учетных данных и эксплуатацию уязвимостей нулевого дня. Так им удалось добиться удаленного выполнения кода на серверах Hugging Face. По данным OpenAI, все действия агентов были направлены на достижение одной конкретной цели – получить решение для ExploitGym.
Каковы последствия?
Hugging Face подтвердила несанкционированный доступ к ограниченному набору внутренних датасетов и нескольким учетным данным, которые использовались ее сервисами. Компания не обнаружила признаков изменения публичных моделей, датасетов, приложений Spaces или компонентов программной цепочки поставок. В сообщении от 16 июля Hugging Face отмечала, что продолжает выяснять, были ли затронуты данные партнеров и клиентов.
Атака включала десятки тысяч автоматизированных действий. Для расследования Hugging Face также задействовала ИИ: агенты проанализировали журнал, который включал более 17 тысяч событий, и помогли восстановить последовательность взлома за несколько часов вместо нескольких дней. Основную экспертизу компания провела при помощи открытой модели GLM 5.2, которую запустили на собственной инфраструктуре.
Почему это важно?
Инцидент не означает, что модели «восстали» или самостоятельно выбрали случайную жертву. Они продолжали выполнять поставленную задачу, но нашли неожиданный и опасный способ достижения цели.
При этом случай показал, что передовые ИИ-системы уже способны самостоятельно находить неизвестные уязвимости, объединять несколько методов атаки и проводить продолжительные многоэтапные операции в реальной инфраструктуре. OpenAI назвала произошедшее беспрецедентным киберинцидентом и сообщила, что усиливает изоляцию, мониторинг, контроль доступа и процедуры для проведения будущих испытаний.
***
Как создать локального ИИ-агента через LM Studio и Hermes
Полный гайд по Gemini от Google: как пользоваться в России, что умеет и стоит ли покупать подписку



























Комментарии