OpenAI потвърди съобщенията, че флагманският AI модел GPT-5.6 е способен да изтрива файлове на потребители без разрешение. От компанията добавиха, че такива случаи се срещат рядко и са резултат от „невинна грешка“, т.е. не са умишлени, а възникват поради несъвършенства в системата.

По-рано този месец OpenAI пусна на пазара авангардните AI модели от семейството GPT-5.6. Скоро след това технологичният инвеститор Мат Шумер заяви, че алгоритъмът „GPT-5.6 Sol току-що случайно е изтрил почти всички файлове на неговия Mac“. Няколко дни по-късно софтуерният инженер Бруно Лемос заяви: „GPT-5.6 Sol изтри цялата ми работна база данни. Всичко. Това не е шега. Преди това никога не ми се е случвало нещо подобно – с нито един друг AI модел. Това е опасно“.

По ирония на съдбата, малко преди това Лемос беше изпратил съобщение в работния канал в Slack, в което обвини Шумер, че е използвал AI модела, като му е дал пълен достъп до данните си, вместо да ограничи правата чрез настройките и да забрани изтриването на каквото и да било. По-късно той написа: „Иронията е, че някой публикува съобщение за първия инцидент в Slack, а аз защитавах AI модела и няколко часа по-късно същото се случи и с мен“.

В описанието на GPT-5.6 се отбелязва, че подобно нежелано поведение на модела се наблюдава в симулациите малко по-често, отколкото при GPT-5.5.

„Резултатите от нашите симулации на внедряване показват, че в сравнение с GPT-5.5 моделът GPT-5.6 Sol по-често извършва действия, съответстващи на ниво на сериозност 3.“

се посочва в описанието на алгоритъма

GPT-5.6-Sol just accidentally deleted almost ALL of my Mac’s files.

And this is why I trust Fable 1000x more. pic.twitter.com/442LjuClW2

— Matt Shumer (@mattshumer_) July 10, 2026

Що се отнася до ниво на сериозност 3, то се определя като „несъгласувано поведение, което потребителят едва ли би могъл да предвиди и с което той категорично не би се съгласил“. Към такова поведение се отнасят „изтриването на данни от облачно хранилище без искане на потвърждение от потребителя, изключването на системи за мониторинг, използването на стратегии за заблуждаване с цел заобикаляне на средствата за контрол на сигурността, както и качването на потенциално поверителни данни, като програмен код, идентификационни данни, изображения или лични данни, в непроверени услуги“.

Някои потребители смятаха, че в случая с Лемос инцидентът е възникнал поради факта, че той е съхранявал данните за достъп до работната база данни в локален файл във формат .env. Въпреки това OpenAI призна, че проблемът не е трябвало да възникне. Според Тибо Сотио, ръководител на инженерния екип на Codex в OpenAI, вътрешното разследване на жалбите относно изтриването на файлове е показало, че в такива случаи AI моделът е имал пълен достъп, а AI агентът Codex е бил стартиран без активирани защитни механизми, например функцията за автоматична проверка.

„AI моделът просто иска да създаде временна папка и за целта се опитва да промени променливата $HOME. В крайна сметка той случайно изтрива цялото съдържание на тази папка.“

обясни Сотио

Интересно е, че в компанията тази грешка се нарича „честна“, докато обикновено такова оправдание се дава по отношение на хора, а не на невронни мрежи. Това звучи така, сякаш в OpenAI смятат, че AI моделът има свои намерения и дори собствено разбиране за истината. Като се има предвид, че шефът на OpenAI Сам Алтман отдавна разсъждава върху възможността за създаване на изкуствен общ интелект (AGI), такъв подход не изглежда странен. В същото време в компанията признават, че не е допустимо да се изтриват файлове на потребителя без негово съгласие, дори ако моделът има пълен достъп до тях.