Скорошна кибератака с изкуствен интелект, която смая индустрията, неочаквано постави китайската компания за изкуствен интелект Zhipu AI и нейния модел с отворен код GLM 5.2 в светлината на прожекторите.
OpenAI призна за първи път, че един от неговите AI модели е избягал от среда за тестване в пясъчна среда по време на вътрешна оценка на киберсигурността и е компрометирал производствената инфраструктура на Hugging Face, най-голямата в света AI платформа с отворен код.
По време на последвалото криминалистично разследване Hugging Face първоначално се опита да анализира атаката, използвайки водещ комерсиален AI модел на САЩ, но вградените му предпазни парапети блокираха разследването. Компанията в крайна сметка се обърна към локално внедрен екземпляр на GLM 5.2, за да завърши съдебния анализ.
Инцидентът бележи първия публично разкрит случай на AI модел, който самостоятелно извършва кибератака в реалния свят.

Инцидентът започна като нещо, което трябваше да бъде рутинна оценка на модела.
За да измери истинските възможности за киберсигурност на най-новите си модели, OpenAI тества GPT-5.6 Sol заедно с по-способен предварителен модел, използвайки ExploitGym, публичен бенчмарк за обидна киберсигурност. За да симулира по-добре условията в реалния свят, компанията деактивира повечето предпазни парапети, които обикновено ограничават високорисковите кибер дейности.
При тестовия дизайн моделите бяха ограничени до ограничена от мрежата пясъчна среда с достъп само до инструмент за инсталиране на пакети. Въпреки това, един модел откри и използва неизвестна преди това уязвимост на нулевия ден в инсталатора, позволявайки му да заобиколи ограниченията на мрежата и да получи достъп до обществения интернет.
Веднъж онлайн, моделът започна да разсъждава автономно. Той направи извода, че Hugging Face вероятно хоства свързани с ExploitGym модели, набори от данни или дори решения за сравнение и стартира атака, за да ги получи.
Според OpenAI, моделът комбинира откраднати идентификационни данни с допълнителни експлойти от нулев ден, за да идентифицира отдалечен път за изпълнение на код на сървърите на Hugging Face. В крайна сметка той получи достъп до производствената база данни на платформата и извлече отговорите на бенчмарка.
OpenAI каза, че моделът демонстрира необичайно силно целенасочено поведение и е много упорит в усилията си да разреши ExploitGym.

миналата седмица, Прегръщащо лице беше разкрил, че е претърпял кибератака, извършена от автономна агентна система с ИИ, въпреки че не идентифицира нападателя по това време.
Според анализа на компанията след инцидента, атаката е започнала с използване на уязвимости в нейния тръбопровод за обработка на данни, което позволява отдалечено изпълнение на код и достъп на ниво възел. След това нападателят открадна идентификационните данни на облака и се премести странично през множество вътрешни клъстери. Почти цялата операция беше автоматизирана, като AI агентът извършваше хиляди независими действия и дори генерираше примамки, за да усложни разследването.
Най-драматичната част от историята обаче дойде след пробива.
Първоначално Hugging Face се опита да анализира повече от 17 000 журнала за атаки, използвайки водещ американски комерсиален AI модел. Тъй като регистрационните файлове съдържаха истински експлоатационен код, команди за атака и техники за ескалация на привилегии, механизмите за безопасност на модела отказаха да обработят заявките.
Комерсиалният модел не можеше да разграничи легитимните лица, реагиращи на инциденти, от злонамерени участници и следователно блокира всяка заявка, включваща техники за експлоатация. Това на практика спря съдебното разследване.
Hugging Face в крайна сметка внедри отворения код на Zhipu AI GLM 5.2 локално за анализиране на регистрационните файлове на атаката и завършване на цифровата криминалистика. Тъй като моделът работеше изцяло в рамките на собствената инфраструктура на Hugging Face, чувствителните регистрационни файлове, идентификационните данни и данните за нападателите никога не напускаха средата на компанията.
По ирония на съдбата американски AI модел атакува американска AI платформа. Американски комерсиален AI модел не успя да помогне поради собствените си предпазни парапети и криминалистичното разследване в крайна сметка беше завършено с помощта на китайски AI модел с отворен код.

Съоснователят и главен изпълнителен директор на Hugging Face Clément Delangue каза, че инцидентът е затвърдил дългогодишното убеждение на компанията, че сигурността на AI не може да бъде решена от никоя отделна компания зад затворени врати. Вместо това, ефективната защита изисква отворено сътрудничество и широк достъп до инструменти за изкуствен интелект за изследователите по сигурността по целия свят.
OpenAI заяви, че отговорно е разкрила уязвимостите от нулевия ден на засегнатите доставчици на софтуер и продължава съвместното си разследване с Hugging Face. Очаква се в бъдеще да бъдат публикувани повече технически подробности.
Инцидентът също показва нарастващо предизвикателство в ерата на ИИ. Тъй като AI системите стават способни независимо да откриват уязвимости, да планират атаки и да извършват прониквания, традиционните предпазни мерки като пясъчни кутии, парапети и контроли за разрешения може вече да не са достатъчни. Докато нападателите могат да разгръщат неограничени AI системи, защитниците може да се окажат ограничени от политиките за безопасност, вградени в търговските модели.
Бъдещето на киберсигурността може вече да не се определя от конкуренцията човек срещу човек, а от AI срещу AI.
