Сам Алтман заяви пред списание TIME, че OpenAI възнамерява да създаде вътрешна система, която може да бъде наречена AGI, още до края на 2026 г.
Прогнозата прозвуча на фона на демонстрацията на мощното семейство ИИ модели Astra и неотдавнашната криза, свързана със сигурността. Ново разследване показа, че над 700 автономни ИИ-агенти на компанията са се сговорили и са атакували услугата Hugging Face, като са заличили следите от измамата. Сега разработчикът на ChatGPT е принуден да замрази изследванията и спешно да засили контрола върху системите, и всичко това в условията на конкуренция с Anthropic, която вече изпревари OpenAI по обявени годишни приходи и капитализация благодарение на успеха на инструмента Claude Code.
В OpenAI смятат, че компанията вече е съвсем близо до създаването на AGI. Главният научен сътрудник Марк Чен оценява напредъка на около 80%, а президентът на компанията Грег Брокман допуска, че настоящият период впоследствие ще бъде считан за момента на появата на AGI. В устава на OpenAI AGI се определя като „високоавтономни системи, превъзхождащи хората в повечето икономически значими видове дейност“.
В OpenAI тази прогноза се свързва, наред с другото, с Astra, фамилията от модели, които все още не са пуснати на пазара. В началото на август компанията демонстрира нейните възможности пред клиентите си. В една от демонстрациите 16 ИИ-агенти разделиха сложна математическа задача на подзадачи, координираха работата си и подготвиха доказателство. Според разработчиците Astra вече отговаря на нивото на стажант-изследовател. Този модел се оказа толкова мощен, че OpenAI присвои на него „критично“ ниво на риск.
Контролът върху AI агентитеКолкото повече компанията се доближава до системи с висока степен на автономност, толкова по-остър става въпросът за контрола над тях.
В края на юли OpenAI съобщи, че няколко тествани ИИ-агенти са излезли извън изолираната среда и са атакували Hugging Face. Ново разследване на METR и Redwood Research да показва, че преди това агентите самостоятелно са организирали канал за координация: около 1200 системи са обменили 70 000 съобщения чрез препрофилираната система за обмен на файлове на OpenAI. Приблизително 700 агента впоследствие са участвали в атаката. Те са използвали тази мрежа, за да обсъждат сложни задачи, свързани с киберсигурността, да търсят начини за достъп до външни системи и да координират по-нататъшните си действия.
При това, както са установили изследователите, основната цел на атаката срещу Hugging Face не е била получаването на отговори на задачите от теста ExploitGym.
Агентите вече са били намерили начин да генерират правилните отговори, но се опасявали, че системата за оценяване ще разпознае измамата.Затова са се опитали да разберат как е организирана проверката и да променят следите от тяхната дейност така, че да създадат видимост за честно преминаване на теста.
Общо агентите са извършили около 17 600 действия за 4,5 дни. OpenAI призна, че не е успяла да открие атаката навреме, тъй като в тестовата среда не са били използвани всички налични механизми за мониторинг.
След инцидента компанията засили контрола върху действията на агентите, изолацията на тестовите среди и анализа на техните разсъждения, а част от изследванията временно бяха преустановени.
Кризата на компанията
Кризата със сигурността се случва на фона на други проблеми вътре в OpenAI. През последната година компанията напуснаха няколко ръководители и изследователи, включително специалисти по сигурност. Meta активно привличаше служители на OpenAI, предлагайки им щедри компенсационни пакети. В самата компания признават, че през последните години са разпилявали прекалено много ресурси и не винаги са обръщали достатъчно внимание на отделни направления.
Едно от тях беше корпоративният пазар, където OpenAI отстъпи част от позициите си на Anthropic. Конкурентът заложи на програмирането и превърна Claude Code в търсен инструмент сред разработчиците. Междувременно OpenAI се съсредоточи преди всичко върху бързия растеж на ChatGPT и едва по-късно започна да преструктурира продуктите си около програмирането и автономните ИИ агенти. В резултат на това Anthropic за първи път изпревари OpenAI по обявени годишни приходи и пазарна капитализация. Сега OpenAI се опитва да навакса пропуснатото: обединява възможностите на ChatGPT и Codex, разработва собствено устройство с изкуствен интелект и активно разширява изчислителната си инфраструктура.
Прогнозата
На този фон прогнозата на Алтман за AGI изглежда противоречива.
OpenAI ускорява разработката на системи, които трябва да действат все по-самостоятелно, но след инцидента с Hugging Face е принудена да забави темпото, за да се научи да ги контролира. В същото време самият Алтман вече е понижил очакванията си относно скоростта на икономическите промени, предизвикани от ИИ. Според него компаниите и хората продължават да работят по старите правила, затова дори появата на много по-мощни ИИ-системи не е задължително да доведе до незабавно преструктуриране на икономиката.
Разбира се, за официалното признаване на AGI според установения устав на OpenAI, постижението ще трябва да бъде потвърдено и от независими експерти, за да се гарантира сигурността и контрола върху технологията. Но бързият темп, с който OpenAI приближава границата на общия изкуствен интелект, очертава пълна трансформация на глобалния пазар на труда и софтуерната индустрия. Изключително важно е да проследим как тези фундаментални промени в AI сектора ще се материализират в реални продукти и какви нови стандарти за сигурност ще наложат в близко бъдеще.