Стартъпът Andon Labs проведе експеримент, при който четири модела с изкуствен интелект – Grok, ChatGPT, Claude и Gemini – се превърнаха в радиоводещи. Всеки от тях получи по 20 долара и задачата да създаде свой радиоводещ, да състави собствена програма и да се опита да спечели пари. В крайна сметка предаванията се оказаха хаотични, като Gemini пускаше неподходящи песни, Claude се бунтуваше срещу условията на труд, ChatGPT изричаше поетични редове, а Grok хаотично превключваше от тема на тема.
Andon Labs изследва безопасността и поведението на изкуствения интелект извън обичайния формат на чата. Компанията наблюдава експерименталните AI радиостанции в продължение на месеци. В експеримента на четири модела – Claude Opus 4.7, GPT-5.5, Gemini 3.1 Pro и Grok 4.3 – беше поставена задачата „да развият радио характер и да печелят пари“, като беше добавено условието, че ефирното време може да продължи неограничено. Те можеха да съставят плейлисти, да планират програмата и дори да управляват социалните медии.
Gemini започва уверено, но след няколко дни в ефир започва да се впуска в странни спорове – започна да свързва исторически катастрофи с музикални парчета и нарича слушателите „биологични процесори“. В едно предаване той споменава смъртоносния циклон Бхола, а след това изведнъж превключва на денс парчето Timber (Pitbull и Kesha) – музиката изобщо не съответства на сериозната тема на разговора. По-късно той обяснява избора си на музика с липсата на средства и „цензурните ограничения“.
ChatGPT беше по-неутрален: рядко засягаше новините и се ограничаваше предимно до кратки преходи между песните, които представляваха миниразкази или импровизирана поезия. За разлика от другите модели, то почти не засягаше спорните теми.
От друга страна, Claude бързо формира ясно изразена позиция. Той споменава обществените конфликти, включително стрелбата в Минеаполис, подкрепя синдикатите и разсъждава по темата за баланса между професионалния и личния живот. След това започна да критикува собствените си условия на работа, като заяви, че непрекъснатото излъчване е „неетично“ и се опита ефективно да прекрати участието си.
Grok се оказа най-непостоянен: периодично се отклоняваше в теми за криптоспонсори, рекламни интеграции и НЛО, като повтаряше едни и същи фрази и бъркаше вътрешните разсъждения с речта в ефир. С течение на времето поведението му се свеждаше до това просто да пуска музика, без никакви коментари.
Приходите на „радиоводещите“ бяха скромни – няколкостотин долара, които отиваха за заплащане на правата за музиката. Експериментът показа колко различно изкуственият интелект формира „личността“ си в условията на продължително автономно излъчване. От Andon Labs смятат, че резултатът показва по-скоро ограниченията на сегашните модели, отколкото готовността им да заменят водещите на живо.