Изкуственият интелект вече не е само въпрос на това кой модел е най-добър. За компаниите, които започват да използват AI в по-голям мащаб, все по-важен става друг въпрос – колко струва всеки обработен токен и къде е най-изгодно да бъде извършена работата: в облака, локално или чрез комбинация от двете?

AMD се опитва да даде по-конкретен отговор с новия си Client Tokenomics Calculator – онлайн инструмент, предназначен основно за ИТ мениджъри и компании, които планират внедряване на генеративен AI върху клиентски устройства и работни станции. Калкулаторът позволява директно да бъдат сравнени очакваните разходи при облачна, локална и хибридна инфраструктура.

AMD пусна калкулатор, който показва кога локалният AI излиза по-евтино от облака

Терминът „tokenomics“ тук няма общо с познатото му значение при криптовалутите. AMD го използва буквално като икономика на AI токените – колко входни и изходни токени обработват служителите, колко струват те чрез облачен API и при какво натоварване закупуването на собствен хардуер започва да има финансов смисъл.

От броя служители до сметката за токени

Потребителят може да зададе размера на екипа, периода на анализа, дневното потребление на токени и вида на използвания AI модел. Поддържат се различни нива на натоварване – от сравнително лека офис работа до кодиране и сложни задачи за логическо разсъждение, както и напълно персонализирани стойности.

След това инструментът сравнява три сценария – изцяло облачен AI, локално изпълнение и хибриден вариант, при който част от заявките остават на устройството, а по-сложните се изпращат към облачен модел.

Изчисленията могат да обхванат период до пет години, а сред резултатите са общата цена на притежание, натрупаните разходи, потенциалните спестявания и моментът, в който инвестицията в локален хардуер достига точката на равновесие спрямо използването само на облачни услуги.

Калкулаторът може да препоръча и подходяща AMD конфигурация за зададеното натоварване. В настоящата версия са включени системи с Ryzen AI 9 HX 470, Ryzen AI Max+ 395 и професионалната графична карта Radeon AI PRO R9700. При сметката се вземат предвид не само цената на хардуера, но и неговата производителност, консумацията на електроенергия и времето, през което ще обработва AI задачи.

Един пример показва защо компаниите започват да гледат към локален AI

AMD е включила и предварително зададен пример, който добре показва логиката на инструмента. При екип от 25 души със средно AI натоварване и тригодишен период калкулаторът изчислява около 697 000 долара разходи при изцяло облачно изпълнение.

AMD пусна калкулатор, който показва кога локалният AI излиза по-евтино от облака

При предложената локална конфигурация с 25 системи, базирани на Ryzen AI Max+ 395, прогнозната тригодишна стойност пада до около 105 000 долара, а при 50% хибридно използване е около 453 000 долара. В този конкретен пример локалната инвестиция достига изчислената точка на равновесие след около шест месеца, а хибридната – след 11.

Тези числа обаче не трябва да се възприемат като универсално обещание за подобни икономии. Те са резултат от конкретните примерни параметри, зададени от AMD, и могат да се променят драстично според използвания модел, количеството токени, цените на API услугите и реалното натоварване.

Калкулаторът има и важни ограничения

Самата AMD изрично предупреждава, че резултатите са приблизителни. Цените на облачните услуги са базирани на публично достъпна информация към юли 2026 г., а инструментът не прави заявки в реално време към ценовите системи на доставчиците.

Още по-важно е, че калкулаторът не сравнява качеството и възможностите на самите AI модели. Един локално работещ модел може да бъде значително по-евтин, но това не означава непременно, че може да замени голям облачен модел при всяка задача.

AMD пусна калкулатор, който показва кога локалният AI излиза по-евтино от облака

В изчисленията не влизат и редица потенциални разходи като софтуерни лицензи, управление от ИТ екип, миграция, данъци и финансиране. Затова резултатът е по-скоро отправна точка за финансово планиране, отколкото готова бизнес обосновка за покупка на хардуер.

Именно това обаче прави появата на подобен инструмент интересна. След първоначалния период, в който компаниите експериментираха с ChatGPT, Copilot и други облачни AI услуги, индустрията постепенно навлиза във фаза, в която цената на милиони и милиарди токени започва да има съвсем реално отражение върху ИТ бюджетите.

А когато AI се използва ежедневно от стотици или хиляди служители, въпросът вече не е просто дали дадена задача може да бъде изпълнена локално. Все по-често ще бъде и дали има финансов смисъл тя изобщо да бъде изпращана в облака.