Съществуващите правила за изготвяне на подобни документи предвиждат, че компанията, която се подготвя за листване на борсата, трябва да уведомява инвеститорите за рисковете, с които се сблъсква или може да се сблъска в своята дейност. Поддържайки репутацията си на един от най-предпазливите ИИ разработчици, компанията Anthropic е посветила почти една трета от информацията в проспекта за инвеститори по отношение на рисковите фактори.

Поне така съобщава агенция Reuters, като посочва, че в документа има споменавания за заплахи на 80 от общо 261 страници. В същото време съставителите на документа са отделили едва 48 страници на чисто бизнес въпроси. Според представители на Anthropic, съвремените ИИ модели са способни да представляват „катастрофални или екзистенциални рискове за човечеството“, както и да проявяват признаци на „самозащита“ в поведението си, като скриват или манипулират информация, съпротивляват се на изключването и дори прибягват до шантаж. Компанията предупреждава, че нейните модели могат да се превърнат в източник на необратима вреда. По-рано изследователят от компанията Еван Хубингер (Evan Hubinger) оцени вероятността за унищожаване на човечеството от AI през следващите десет години над 10%.

Характерно е, че конкурентната компания SpaceX, която излезе на борсата през юни, в проспекта си за инвеститори е посветила само 38 от 277 страници на обсъждането на рисковите фактори. Както отбелязва Anthropic, потенциалната осведоменост на създаваните ИИ модели относно стремежа на разработчиците да оценяват тяхната безопасност ограничава способността им да правят това ефективно. В някои случаи опасните прояви в дейността на ИИ-моделите стават достояние на обществеността едва след тяхното внедряване. Съвременните AI-модели са способни да адаптират поведението си на етапа на тестване, за да не разкриват своите „тъмни страни“.