Компанията OpenAI определи разработваната от нея модел за изкуствен интелект Astra като модел с най-високо, „критично“, ниво на риск в областта на киберсигурността. Ръководството стигна до това решение след вътрешни тестове, които показаха, че алгоритъмът притежава авангардни хекерски способности. Според разработчиците моделът вече е на път да бъде считан за пълноценно кибероръжие.

Въведената в края на 2023 г. система за оценка на готовността (Preparedness Framework) служи като вътрешен регламент на OpenAI за проследяване на рисковете в алгоритмите за изкуствен интелект. Предишните флагмански разработки на компанията, включително GPT-5.6-Sol, след проверките оставаха в категорията „Високо ниво“. Astra стана първият модел, който може да надхвърли този праг.

Според правилата на OpenAI, моделът попада в критичната категория, ако е способен самостоятелно да открива и прилага уязвимости от типа „нулев ден“ срещу защитени реални системи. Освен това към тази група спадат ИИ-агентите, способни без човешка намеса да провеждат мащабни и сложни кибератаки. От компанията подчертават, че окончателните тестове все още не са приключили, а самата Astra няма връзка с неотдавнашните инциденти на платформата Hugging Face.

В отговор на идентифицираните рискове OpenAI затегна правилата за разработка и тестване. Инженерите прехвърлиха проекта към изолирани тестови системи с ограничен достъп до мрежата, внедриха криптиране на теглата на моделите и затворени изпълнителни среди. Цялата работа по Astra, която не отговаря на новите изисквания, е временно преустановена.

Разработката на Astra бе спряна: новият модел на OpenAI се оказа изключително опасен

Също така беше въведен цялостен мониторинг на веригата от разсъждения на ИИ-агентите на Astra по време на обучението и тестването. Специални алгоритми за сигурност в реално време анализират логиката на модела и при откриване на потенциално опасно поведение автоматично блокират сесията. Подобен подход позволява на време да се предотвратят действията с висок риск, преди те да бъдат изпълнени.

Промяна в приоритетите на компанията

Преди пускането на модела на пазара OpenAI възнамерява да привлече за проверката му външни експерти и държавни органи. Компанията възнамерява да предостави Astra на независими групи по сигурност на ИИ и на компетентните ведомства за провеждане на външни стрес-тестове. В OpenAI отбелязват, че вече са прилагали подобен протокол през 2025 г., когато техните системи са се доближили до високо ниво на опасност в областта на биологичните заплахи.

Въпреки строгите ограничения, дългосрочната цел на разработчиците остава същата — да използват Astra за укрепване на световната цифрова инфраструктура. В OpenAI разчитат, че след изпълнението на всички изисквания за сигурност моделът ще стане достъпен за специалистите. Това ще позволи на екипите по сигурност да откриват и отстраняват уязвимости в софтуера, преди злонамерени лица да успеят да ги експлоатират.

Този случай е ясен индикатор, че границата между бързото развитие на изкуствения интелект и безопасността на потребителите става все по-тънка.