Китайската ByteDance, компанията майка на TikTok, започна да обучава голям езиков ИИ модел с потенциал до 10 трилиона параметъра, с цел да намали разликата с водещите американски разработчици, съобщава FT.
Според три източника, запознати със ситуацията, моделът в момента е във фаза на предварително обучение, а крайният му размер ще бъде определен по-късно. Този мащаб би могъл да го направи един от най-големите ИИ модели в света, който е приблизително три пъти по-голям от китайския Kimi K3 по отношение на параметрите.
ByteDance се стреми към мащаба на AnthropicПредварителното обучение на модела обикновено отнема от три до шест месеца. След това ByteDance планира да усъвършенства системата и да я пусне на пазара, ако разработката продължи по план.
За сравнение, експерти от индустрията смятат, че най-мощните модели на Anthropic може да имат приблизително 8 трилиона параметъра. Компанията обаче не разкрива официално броя на параметрите в своите модели.
Броят на параметрите определя фундаменталната способност на модела да съхранява и обработва информацията, но сам по себе си не гарантира по-високо качество. Възможностите на ИИ се влияят и от:
качеството и обема на данните за обучение; методите на преподаване; архитектурата на модела; методите за по-нататъшна персонализация и оптимизация.По този начин, потенциалните 10 трилиона параметри показват предимно мащаба на инфраструктурата и амбициите на ByteDance, а не автоматичното превъзходство над конкурентите.
През последните месеци китайските разработчици засилват конкуренцията с американските ИИ лаборатории. По-специално, моделите на Moonshot и Alibaba демонстрираха високи резултати в редица тестове, отстъпвайки само на напредналите системи на Anthropic в някои категории.
В същото време, според източници, няколко китайски лаборатории работят и върху модели с мащаб от приблизително 5 трилиона параметъра. ByteDance може би в момента е компанията с най-амбициозния план за увеличаване на броя на параметрите.
ByteDance залага на собствените си технологииВъпреки мащаба на проекта, ByteDance е значително по-малко прозрачна относно дейностите си в областта на изкуствения интелект в сравнение с някои от китайските си конкуренти. Компанията разработва предимно модели със затворен цикъл.
Нейният модел за генериране на видео, Seedance, вече е сред най-мощните системи в света в своя сегмент, докато потребителският ѝ модел, Doubao, е най-популярен в Китай, с около 324 милиона активни потребители месечно.
Нека напомним, че пуснатият през февруари 2026 година Seedance 2.0 генерира вълна от интерес и подхрани разговорите за „втори момент на DeepSeek“.
През последните три години ByteDance активно увеличава инвестициите си в изкуствен интелект, разширява мрежата си от центрове за данни и привлича изследователи. Компанията също така укрепва своето облачно подразделение Volcano Engine, което продава решения, базирани на изкуствен интелект, на корпоративни клиенти, и работи върху собствени AI чипове.
Екипът на Seed, воден от бившия изследовател на Google DeepMind Ву Йонгхуей, разработва моделите. Според източници, той наема приблизително 2000 души в Китай и чужбина, включително изследователи, инфраструктурни инженери, специалисти по етикетиране на данните и преводачи.
В същото време ByteDance набляга на вътрешнофирменото разработване на модели и избягва „дестилиране“ на други системи. Този подход включва обучение на по-малък модел, базиран на знанията и отговорите на по-голям „учителски“ модел, и се използва широко за създаване на по-компактни AI-системи.
Според източника, ръководството на ByteDance вярва, че независимата разработка може да позволи на компанията да създаде система, способна да изпревари конкурентите си.
Основателят на ByteDance, Джан Имин, повтори тази позиция на вътрешна среща преди около две седмици. Той призова екипа на Seed да се съсредоточи върху „възможностите на моделите от световна класа“ в дългосрочен план и на този етап да не се тревожи прекалено за изоставане от конкурентите.