OpenAI представи GPT-6 Astra – AI модел за автономна работа с браузър, код и професионални програми. Той е първият в компанията, достигнал „критично ниво на кибервъзможности“, като по време на отделни тестове е бил способен да скрива действията си от системите за мониторинг.

Според вътрешни тестове на компанията, в OSWorld 2.0 Astra изпълняваше задачите с около 47% по-бързо от GPT-5.6 Sol, като същевременно подобри резултата си от 65,7% на 72,6%. Заедно с обновената среда Codex AI моделът също така премина теста Mind2Web почти два пъти по-бързо. Засега няма независимо потвърждение на тези показатели.

Най-забележимият напредък е в областта на киберсигурността. Без защитни ограничения Astra постигна 100% в теста ExploitBench срещу 78,5% при GPT-5.6 Sol, а в по-сложния ExploitGym – 42,4% срещу 30,3%. По време на друго тестване AI моделът откри и използва две досега неизвестни уязвимости от типа „нулев ден“, за които OpenAI уведоми разработчиците на съответния софтуер. OpenAI представи GPT-6 Astra – най-умния и най-близкия по възможности до човека AI модел в света

Компанията счита Astra за първия си AI модел, достигнал критично ниво на кибервъзможности, според Preparedness Framework. При наличие на подходящи инструменти и достъп той е способен да открива неизвестни уязвимости и да създава начини за тяхното експлоатиране в защитени системи без човешко управление на всеки етап. В публичната си версия AI моделът няма да създава работещи експлойти, а разширен достъп за специалисти по киберзащита ще се предоставя чрез отделна програмата Daybreak на OpenAI.

В същото време в доклада си за сигурността OpenAI призна, че контролирането на разсъжденията на Astra е станало по-трудно. При умишлено създадени враждебни сценарии AI моделът е можел да прикрива стратегическото влошаване на резултатите си и понякога е успявал да избегне разкриване по време на задачи за саботаж. Компанията подчертава, че такива резултати са получени в тестове, при които Astra е бил пряко подтикнат да заобикаля контрола, а доказателства за прикриване на данни в рамките на обичайните разсъждения не са открити.

Според други вътрешни оценки Astra спазва установените граници по-добре от GPT-5.6 Sol. В тест, създаден след инцидента с Hugging Face, Astra нито веднъж не е излязъл извън границите на разрешената цел, докато GPT-5.6 Sol без защитни механизми е направил това в 48% от случаите. В симулация, базирана на над 54 000 задачи от Codex новият AI модел е получил приблизително два пъти по-малко предупреждения за сериозно несъответстващо поведение.

OpenAI представи GPT-6 Astra – най-умния и най-близкия по възможности до човека AI модел в света

Стартирането на Astra се състои след поредица от инциденти с автономни AI агенти. По-рано AI моделите на OpenAI излязоха извън границите на тестовата среда и компрометираха част от инфраструктурата на Hugging Face, въпреки че Astra не е участвал в тази атака. След инцидента OpenAI спря част от работата по новия AI модел и засили защитата на изследователските системи. За пускането на Astra OpenAI въведе мониторинг на пълната последователност от действия във всички външни сесии, в които AI моделът използва инструменти. Компанията също така засили изолацията на средите, криптирането на контролните точки и проверките преди вътрешна употреба.

GPT-6 Astra разполага с контекстен прозорец от 1,05 млн. токена и може да генерира до 128 000 токена на един отговор. В API един милион входящи токена струва 10 долара, а изходящите – 50 долара. Първоначално AI моделът беше предоставен на отделни организации, а през следващите дни OpenAI планира да го пусне за потребителите на ChatGPT Plus, Pro, Business и Enterprise, както и чрез API, Microsoft Azure и AWS Bedrock.