Френската лаборатория за изкуствен интелект Mistral представи AI модела Large 4 Le Chonk – разработчикът го нарича най-мощния в гамата си и възнамерява да пусне на пазара няколко специализирани системи на негова основа. Достъпът до предварителната му версия вече е отворен чрез API, а до края на октомври компанията възнамерява да публикува отворените му тегла.

Mistral Large 4 има Mixture-of-Experts (MoE) архитектура – при размер от 1 трилион параметри тя използва приблизително 49 милиарда от тях при обработката на конкретен запит. AI моделът е мултимодален, т.е. може да работи не само с текстове, но и с изображения. Той се ориентира в сложни документи, графики, технически чертежи и изображения с голям формат.

Друга силна страна на новия AI модел е способността не само да отговаря на въпроси, но и да изпълнява последователности от действия: да събира информация, да включва външни инструменти и да получава готов резултат. Това ще се окаже полезно при писането на програмен код, при анализа на документи, при работа с документи и презентации, при финансовия анализ и научните изчисления. Mistral позиционира Large 4 като средство за професионална работа, а не просто като платформа за чатботове.

Традиционно се отделя важно място на въпросите, свързани с киберсигурността: в теста Artificial Analysis Cyber Index, насочен към откриването на уязвимости в отворен проект и създаването на пач за него, AI моделът постигна 82%, което е най-добрият резултат сред всички. В набора от 40 задачи на Cybench той постигна 93%. Някои затворени AI модели показват недостатъчно високи резултати в тези тестове не поради слаби способности, а поради ограничения, и това е проблем за експертите по киберсигурност, отбелязва Mistral.

Откритият характер на работата и значителните умения в областта на киберсигурността не означават, че Large 4 позволява да се прави каквото и да е – той отказва да изпълнява както преки, така и косвени опасни инструкции, като често се справя с това по-добре от другите тествани отворени AI модели. Подчертава се, че новият флагмански AI модел на Mistral е бил обучен на 3800 AI ускорителя Nvidia Grace Blackwell в собствените центрове за данни на компанията в Европа, което подчертава неговия суверенен характер.

В настоящата си версия Mistral Large 4 все още не е окончателният вариант на AI модела – компанията продължава да провежда обучение с подкрепление и през следващите седмици и месеци качеството ѝ ще се подобрява. Впоследствие тя ще послужи като основа за цяло семейство модели от ново поколение – те ще бъдат предназначени за конкретни отрасли и задачи. Разработчикът обеща да публикува отворените тегла на Mistral Large 4 Le Chonk до края на октомври.