A Lyria 3.5 teljes dalokat ír, nem csak zenei loopokat

A Lyria 3.5 teljes, néhány perces dalokat készít egyetlen szöveges vagy képi prompt alapján. A Google DeepMind modellje a dalszöveget és az éneket alapértelmezés szerint hozzáadja, a kész szám pedig a Picsart AI Playgroundban érhető el.
- A Lyria 3.5 teljes, néhány perces dalokat készít szövegből vagy képből.
- A rendszer előre megtervezi a dal szerkezetét, majd ezt hangfelvétellé alakítja.
- Ének és dalszöveg alapértelmezés szerint jár a generált számhoz.
- Időbélyegekkel a felhasználó a zenei váltások helyét is megadhatja.
- A modell a Picsart AI Playgroundban érhető el.
A modell előre megtervezi a dal felépítését
A Picsart szeptember 9-i bemutatása szerint a Lyria 3.5 a Google DeepMind Lyria modellcsaládjának legújabb tagja. A rövid zenei klipekre épülő rendszerekkel szemben teljes dalokat állít elő, bevezetővel, verzékkel, visszatérő refrénnel, híddal és lezárással.
A modell először a szerkezetet tervezi meg, majd ezt alakítja hangfelvétellé. Ennek részeként eldönti, mikor érkezzen a refrén, hogyan változzon az energia, és hol legyen kontraszt a dal egyes részei között. A kész hanganyag sztereóban, 44,1 kHz-es minőségben készül.
A felhasználó időbélyegekkel is irányíthatja a számot. Megadhatja például, hogy a bevezető 12 másodpercig tartson, a refrén pedig egy meghatározott időpontban kezdődjön. Ez olyan projekteknél lehet hasznos, ahol a zenei váltásnak egy videó vágásához kell igazodnia.
Szöveggel, hanggal és képekkel is vezérelhető
A Lyria 3.5 éneket és dalszöveget alapértelmezés szerint készít. A felhasználó saját szöveget is beilleszthet, és címkékkel jelölheti a részeket, például a verzét, a refrént vagy a hidat. A dalszöveg helyett témát és hangulatot is megadhat, így a modell maga írja meg az ismétlődő motívumokra épülő szöveget.
A vokál karaktere részletesen leírható. A Picsart példaként említi a füstös, mély női altot, a magas, tiszta női szopránt, a karakteres férfi tenort és a sötét tónusú férfi baritont. A hangszínt műfajjal és előadásmóddal is lehet pontosítani. A modell biztonsági szűrői blokkolják a valódi énekesek hangjának utánzására irányuló kéréseket, valamint a jogvédett dalszövegek reprodukálását.
A rendszer képeket is fogad. A Playground referenciahelyére legfeljebb tíz kép tölthető fel, a modell pedig ezek hangulatából, színeiből és tartalmából komponál zenét. Így egy fotósorozatból, videóképkockákból, termékfotóból vagy tájképből is kiindulhat a zenei aláfestés.
Három Lyria modell közül lehet választani a Playgroundban
A Picsart AI Playground modellválasztójában a Lyria család három változata szerepel. A Lyria 3 Clip rövid klipekhez, loopokhoz és előzetesekhez készült, szöveges vagy képi promptokból. A Lyria 3 Pro vokállal készít hosszabb zenéket, legfeljebb 184 másodperces időtartamban. A Lyria 3.5 teljes kompozíciót ad, szöveges és képi bemenettel, vokállal.
A Picsart szerint a modellek egymás mellett is használhatók: a felhasználó először a Clip változattal készíthet gyors vázlatokat, majd a kiválasztott ötletet a Lyria 3.5-tel dolgozhatja ki. A generálás menete a Playgroundban egyszerű: a modell kiválasztása után meg kell adni a műfajt, a tempót, a hangnemet, a hangulatot és a hangszereket. Ének nélküli zenéhez az „instrumental only” utasítás használható, képalapú munkához pedig legfeljebb tíz referenciafájl csatolható.
A kész szám ugyanabban a munkatérben jelenik meg, ahol a Picsart képei és videói, így a szolgáltatás leírása szerint közvetlenül felhasználható egy vágás mellett vagy hosszabb projekt részeként. A modell jelenleg a Picsart AI Playgroundban érhető el.
Picsart: What is Lyria 3.5? The AI model that writes full songs

