OpenAI представи GPT-6 Astra – AI модел за автономна работа с браузър, код и професионални програми. Той е първият в компанията, достигнал „критично ниво на кибервъзможности“, като по време на отделни тестове е бил способен да скрива действията си от системите за мониторинг.
Според вътрешни тестове на компанията, в OSWorld 2.0 Astra изпълняваше задачите с около 47% по-бързо от GPT-5.6 Sol, като същевременно подобри резултата си от 65,7% на 72,6%. Заедно с обновената среда Codex AI моделът също така премина теста Mind2Web почти два пъти по-бързо. Засега няма независимо потвърждение на тези показатели.
Най-забележимият напредък е в областта на киберсигурността. Без защитни ограничения Astra постигна 100% в теста ExploitBench срещу 78,5% при GPT-5.6 Sol, а в по-сложния ExploitGym – 42,4% срещу 30,3%. По време на друго тестване AI моделът откри и използва две досега неизвестни уязвимости от типа „нулев ден“, за които OpenAI уведоми разработчиците на съответния софтуер.
Компанията счита Astra за първия си AI модел, достигнал критично ниво на кибервъзможности, според Preparedness Framework. При наличие на подходящи инструменти и достъп той е способен да открива неизвестни уязвимости и да създава начини за тяхното експлоатиране в защитени системи без човешко управление на всеки етап. В публичната си версия AI моделът няма да създава работещи експлойти, а разширен достъп за специалисти по киберзащита ще се предоставя чрез отделна програмата Daybreak на OpenAI.
В същото време в доклада си за сигурността OpenAI призна, че контролирането на разсъжденията на Astra е станало по-трудно. При умишлено създадени враждебни сценарии AI моделът е можел да прикрива стратегическото влошаване на резултатите си и понякога е успявал да избегне разкриване по време на задачи за саботаж. Компанията подчертава, че такива резултати са получени в тестове, при които Astra е бил пряко подтикнат да заобикаля контрола, а доказателства за прикриване на данни в рамките на обичайните разсъждения не са открити.
Според други вътрешни оценки Astra спазва установените граници по-добре от GPT-5.6 Sol. В тест, създаден след инцидента с Hugging Face, Astra нито веднъж не е излязъл извън границите на разрешената цел, докато GPT-5.6 Sol без защитни механизми е направил това в 48% от случаите. В симулация, базирана на над 54 000 задачи от Codex новият AI модел е получил приблизително два пъти по-малко предупреждения за сериозно несъответстващо поведение.
Стартирането на Astra се състои след поредица от инциденти с автономни AI агенти. По-рано AI моделите на OpenAI излязоха извън границите на тестовата среда и компрометираха част от инфраструктурата на Hugging Face, въпреки че Astra не е участвал в тази атака. След инцидента OpenAI спря част от работата по новия AI модел и засили защитата на изследователските системи. За пускането на Astra OpenAI въведе мониторинг на пълната последователност от действия във всички външни сесии, в които AI моделът използва инструменти. Компанията също така засили изолацията на средите, криптирането на контролните точки и проверките преди вътрешна употреба.
GPT-6 Astra разполага с контекстен прозорец от 1,05 млн. токена и може да генерира до 128 000 токена на един отговор. В API един милион входящи токена струва 10 долара, а изходящите – 50 долара. Първоначално AI моделът беше предоставен на отделни организации, а през следващите дни OpenAI планира да го пусне за потребителите на ChatGPT Plus, Pro, Business и Enterprise, както и чрез API, Microsoft Azure и AWS Bedrock.