В средата на седмицата Google анонсира поледния ИИ модел, който обещава да направи генерирането на музика още по-съвършено. На 29 юли Google представи новия си модел за генериране на музика, Lyria 3.5, в прессъобщение. Според компанията, той би трябвало да осигури „създаването на песни с най-високо качество“.

В последваща блог публикация се отбелязва, че Lyria 3.5 подобрява „музикалността, текстовете и качеството на вокала“. Що се отнася до музикалността, Google твърди, че потребителите ще могат да създават по-сложни композиции, които звучат по-естествено. Google обяви, че Lyria 3.5 вече започва да се разпространява във Flow Music.

„Разпознаването на потребителските заявки и разбирането на текстовата структура се превърнаха в две ключови области на развитие за Lyria 3.5. Първото би трябвало да помогне на модела по-точно да следва дадена тема и да избягва текстовете, които не съответстват на вашето запитване. Освен това, вокалите в Lyria 3.5 са станали по-ясни и имат подобрено произношение“, съобщава Google.

Всичко това се допълва от обновената система за творчески контрол на Lyria 3.5. Google отбелязва, че вече е по-лесно за потребителите да регулират темпото и дължината на песента. Предлагат се и опции за промяна на вокали, барабани и бас. Освен това, дължината на песните вече може да варира от 30 секунди до три минути.

Бъдете в ритъм с темпото на изкуствения интелект

През февруари Google даде началото на годината с пускането на Lyria 3. Ключовите ѝ функции включваха генериране на музикални записи с дължина до 30 секунди въз основа на текстови заявки или снимки. Презентацията включваше и функции като помощ с текстовете на песните, управление на стиловете и „по-реалистичен звук“.

„Някои от тези функции са запазени в Lyria 3.5. Потребителите все още могат да опишат настроението или атмосферата на желаната песен. Например, можете да помолите системата да създаде „забавен R&B хит“, пише Android Central.

Малко след пускането на Lyria 3 през февруари, Google обяви, че се готви да го интегрира в Dream Track за YouTube Shorts. По подобен начин, няколко месеца по-късно, Google Vids получи моделите Lyria 3 и Veo 3.1. В тази услуга Lyria беше особено полезна за създателите на видеоклипове, които се нуждаят от кратък музикален съпровод или саундтрак с продължителност между 30 секунди и три минути.

Нюанси на функционалността

Една от ключовите особености на екосистемата Lyria остава нейната технология SynthID. Всяка песен, създадена с помощта на моделите на Google, получава цифров воден знак, невидим за човешкото ухо. Този воден знак идентифицира аудиото като генерирано от изкуствен интелект, дори ако файлът е бил компресиран, редактиран или с коригирана скорост. По този начин Google се стреми да направи произхода на генерираното от изкуствен интелект съдържание по-прозрачен и да помогне в борбата с неконтролираното му разпространение.

„Google също така продължава да разширява възможностите на Lyria отвъд Flow Music. Моделът вече се интегрира в други услуги на компанията, включително Gemini, Google Vids, Google AI Studio, Vertex AI и Gemini API. Това означава, че може да се използва както от обикновените потребители за творчески експерименти, така и от разработчиците, които искат да интегрират генерирането на музика в своите приложения или услуги“, се казва в официалния блог на Google.

За професионална употреба Google се фокусира не само върху автоматизираното генериране на композиции, но и върху по-прецизния творчески контрол. Използвайки специални инструменти, потребителите могат да работят отделно върху интрота, куплети, припеви и други части от песента, променяйки тяхната структура и интензивност. Този подход има за цел да направи изкуствения интелект не заместител на музикантите, а инструмент за бързо създаване на чернови и разработване на творчески идеи.