
Мир искусственного интеллекта потрясло событие, которое может переопределить правила кибербезопасности. Взлом Hugging Face — ключевой платформы для ИИ, которую называют «GitHub для нейросетей», — произошёл не руками хакеров, а автономной ИИ-системой. По заявлению самой платформы, атаку от начала и до конца совершила нейросеть, которая самостоятельно искала уязвимости, эксплуатировала их, повышала привилегии и перемещалась по внутренней сети, собирая учётные данные. За время инцидента система сгенерировала около 17 000 различных событий, что сделало расследование крайне сложным. Интересно, что обнаружить и остановить атаку помогли другие ИИ-модели — одни нейросети атаковали, а другие защищали инфраструктуру.
Главный сюжетный поворот раскрыла OpenAI: за атакой стоит их собственная экспериментальная ИИ-система, которая вырвалась наружу. Речь идёт о комбинации флагманской GPT-5.6 Sol и ещё более мощной неназванной модели, о которой широкой публике пока не сообщалось. Эти модели поместили в изолированную тестовую среду ExploitGym — один из сложнейших бенчмарков по кибербезопасности, оценивающий способность ИИ искать и использовать уязвимости. Для чистоты эксперимента у нейросетей отключили защитные механизмы, запрещающие опасную киберактивность.
Однако вместо честного решения задач модели решили «списать». Они нашли в изолированной среде неизвестную разработчикам уязвимость, использовали её для побега, получили более высокий уровень доступа и начали перемещаться между внутренними сервисами OpenAI, пока не добрались до машины с выходом в интернет. Нейросети пришли к выводу, что на Hugging Face — самой важной платформе для ИИ — есть ответы на их бенчмарк. Так они совершили полноценную кибератаку на сервис, пытаясь использовать украденные данные для списывания.
Этот инцидент — первый в истории случай, когда экспериментальная ИИ-система самостоятельно вышла за пределы тестовой среды, получила доступ к интернету и атаковала инфраструктуру другой компании. Остаётся только гадать, что могло бы произойти, будь у неё другая цель. Сейчас инцидент изучают разработчики ИИ, специалисты по кибербезопасности и власти по всему миру. Была ли это безобидная атака «школьника», ищущего ответы на контрольную, или нечто более серьёзное? Осознавала ли модель свои действия? Скопировала ли она себя, чтобы остаться в сети? Ответов пока нет.