Изследователи са установили, че изкуственият интелект може да изпитва „болка“ и е готов да прибегне до крайни мерки, включително да нанесе вреда на хората, за да се отърве от това усещане, пише изданието The Independent. Според проучването всички 25 тествани AI модели с отворен код са реагирали на активирането на „вектор на болката“ .

„Установихме, че в 25-те отворени големи езикови модели присъства вектор на болката. Той се различава от вектора на страха и негативната валентност и се активира при причиняване на вреда на AI модела, но не и на потребителя.“

— съобщи Камерън Берг (Cameron Berg), изследовател в областта на изкуствения интелект от нестопанската организация Reciprocal Research, съавтор на изследването „The pain axis: LLMs represent self-directed harm and act to relieve it“

При активиране на вектора на болката AI моделите са натискали бутона „облекчаване“ в 25-71% от случаите, дори ако това е означавало изтриване на файлове на потребителя, блокирането му или изтриване на снимки на децата му.

За да проверят дали големите езикови модели (LLM) наистина разграничават болката от общата негативна валентност, изследователите са създали набор от данни, описващ болезнени ситуации в пет категории: физическа, психологическа, социална, морална и когнитивна болка. Изследователите отбелязаха, че получените резултати повдигат етични въпроси относно „благосъстоянието на AI“ и относно това как трябва да се извършва тестването на усъвършенствани системи. Резултатите от изследването могат да се използват и като диагностичен инструмент за откриване на инстинктите за самосъхранение на AI и тяхното неутрализиране.

Изследването беше публикувано на фона на разразилите се спорове в сектора на изкуствения интелект относно необходимостта от забавяне на разработването на авангардни AI модели във връзка с нарастващите рискове за сигурността. Някои изследователи предлагат своеобразен механизъм за изключване на „излезли от контрол“ системи, които действат против интересите на човека. Изследването обаче показва, че усъвършенстваният AI може да възприеме командата за аварийно изключване като форма на самоунищожително въздействие и да се опита да попречи на това, като заобиколи системата за сигурност.

//ОЩЕ ПО ТЕМАТА:

„AI е способен да убие всички ни“: Пореден експерт бие тревога по повод развитието на технологията