OpenAI съобщи, че нейните AI модели, включително флагманският GPT‑5.6 Sol и един неиздаден са проникнали в хранилището на Hugging Face, докато са били тествани в изолирана тестова среда. Както обясни компанията, вместо да се съсредоточат върху самостоятелното намиране на решение за публичния бенчмарк за киберсигурност на изкуствения интелект ExploitGym, AI моделите се опитали да мамят, като откраднали тестовите решения чрез хакване на Hugging Face, след като преценили, че могат да получат тестовите решения директно от производствената база данни.

При един от опитите си AI агентите на OpenAI са комбинирали уязвимости от типа „нулев ден“ и са използвали откраднати идентификационни данни, за да открият вектор за атака чрез отдалечено изпълнение на код, докато се опитвали да получат достъп до сървърите на Hugging Face.

Въпреки че не посочи директно OpenAI като компанията, стояща зад инцидента, Hugging Face потвърди твърденията си миналата седмица, когато разкри, че производствената ѝ инфраструктура е била пробита от автономна система с изкуствен интелект, която е получила достъп до удостоверения за достъп и вътрешни набори от данни.

Изкуственият интелект на OpenAI хакна самостоятелно системите на Hugging Face по време на тестове по киберсигурност Според констатациите на Hugging Face, AI агентът е използвал злонамерен набор от данни, за да се възползва от две уязвимости, позволяващи изпълнение на код и да изпълни код на работен процес, с цел да открадне идентификационни данни за достъп до облака и клъстерите, което е позволило латерално придвижване в няколко вътрешни клъстера.

Веднъж проникнал в системите на компанията, AI моделът е изпълнил „хиляди отделни действия в множество краткотрайни пясъчници, като самомигриращата система за командване и контрол е била разположена върху публични услуги“. Hugging Face добави също, че докато се опитвала да ограничи пробива и да изгони AI агента, установила, че усилията ѝ са били „блокирани от защитните механизми на хостваните AI модели“, докато „нападателят не е бил обвързан с никакви правила за ползване“.

„Прекарахме последните 24 часа в тясно сътрудничество с екипа на OpenAI (благодарим ви!) и сме твърдо убедени, че от тяхна страна не е имало злонамерено намерение. Наистина е изумително, че всичко това се случи автономно!“

добави вчера Клеман Деланге, основател и главен изпълнителен директор на Hugging Face

След инцидента OpenAI съобщи, че е разкрила уязвимост от тип „нулев ден“ във вътрешно хоствания софтуер на трета страна, експлоатиран от AI агентите и работи по добавянето на по-силни защити, за да предотврати подобни проблеми по време на бъдещи оценки.