Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A Lyria 3.5 teljes dalokat ír, nem csak zenei loopokat

2026. szeptember 9.Forrás: Picsart
A Lyria 3.5 teljes dalokat ír, nem csak zenei loopokat
Kép: Picsart

A Lyria 3.5 teljes, néhány perces dalokat készít egyetlen szöveges vagy képi prompt alapján. A Google DeepMind modellje a dalszöveget és az éneket alapértelmezés szerint hozzáadja, a kész szám pedig a Picsart AI Playgroundban érhető el.

A lényeg röviden
  • A Lyria 3.5 teljes, néhány perces dalokat készít szövegből vagy képből.
  • A rendszer előre megtervezi a dal szerkezetét, majd ezt hangfelvétellé alakítja.
  • Ének és dalszöveg alapértelmezés szerint jár a generált számhoz.
  • Időbélyegekkel a felhasználó a zenei váltások helyét is megadhatja.
  • A modell a Picsart AI Playgroundban érhető el.

A modell előre megtervezi a dal felépítését

A Picsart szeptember 9-i bemutatása szerint a Lyria 3.5 a Google DeepMind Lyria modellcsaládjának legújabb tagja. A rövid zenei klipekre épülő rendszerekkel szemben teljes dalokat állít elő, bevezetővel, verzékkel, visszatérő refrénnel, híddal és lezárással.

A modell először a szerkezetet tervezi meg, majd ezt alakítja hangfelvétellé. Ennek részeként eldönti, mikor érkezzen a refrén, hogyan változzon az energia, és hol legyen kontraszt a dal egyes részei között. A kész hanganyag sztereóban, 44,1 kHz-es minőségben készül.

A felhasználó időbélyegekkel is irányíthatja a számot. Megadhatja például, hogy a bevezető 12 másodpercig tartson, a refrén pedig egy meghatározott időpontban kezdődjön. Ez olyan projekteknél lehet hasznos, ahol a zenei váltásnak egy videó vágásához kell igazodnia.

Szöveggel, hanggal és képekkel is vezérelhető

A Lyria 3.5 éneket és dalszöveget alapértelmezés szerint készít. A felhasználó saját szöveget is beilleszthet, és címkékkel jelölheti a részeket, például a verzét, a refrént vagy a hidat. A dalszöveg helyett témát és hangulatot is megadhat, így a modell maga írja meg az ismétlődő motívumokra épülő szöveget.

A vokál karaktere részletesen leírható. A Picsart példaként említi a füstös, mély női altot, a magas, tiszta női szopránt, a karakteres férfi tenort és a sötét tónusú férfi baritont. A hangszínt műfajjal és előadásmóddal is lehet pontosítani. A modell biztonsági szűrői blokkolják a valódi énekesek hangjának utánzására irányuló kéréseket, valamint a jogvédett dalszövegek reprodukálását.

A rendszer képeket is fogad. A Playground referenciahelyére legfeljebb tíz kép tölthető fel, a modell pedig ezek hangulatából, színeiből és tartalmából komponál zenét. Így egy fotósorozatból, videóképkockákból, termékfotóból vagy tájképből is kiindulhat a zenei aláfestés.

Három Lyria modell közül lehet választani a Playgroundban

A Picsart AI Playground modellválasztójában a Lyria család három változata szerepel. A Lyria 3 Clip rövid klipekhez, loopokhoz és előzetesekhez készült, szöveges vagy képi promptokból. A Lyria 3 Pro vokállal készít hosszabb zenéket, legfeljebb 184 másodperces időtartamban. A Lyria 3.5 teljes kompozíciót ad, szöveges és képi bemenettel, vokállal.

A Picsart szerint a modellek egymás mellett is használhatók: a felhasználó először a Clip változattal készíthet gyors vázlatokat, majd a kiválasztott ötletet a Lyria 3.5-tel dolgozhatja ki. A generálás menete a Playgroundban egyszerű: a modell kiválasztása után meg kell adni a műfajt, a tempót, a hangnemet, a hangulatot és a hangszereket. Ének nélküli zenéhez az „instrumental only” utasítás használható, képalapú munkához pedig legfeljebb tíz referenciafájl csatolható.

A kész szám ugyanabban a munkatérben jelenik meg, ahol a Picsart képei és videói, így a szolgáltatás leírása szerint közvetlenül felhasználható egy vágás mellett vagy hosszabb projekt részeként. A modell jelenleg a Picsart AI Playgroundban érhető el.

Google DeepMindLyria 3.5PicsartLyria 3 ClipLyria 3 Prozenemultimodális AI

Kapcsolódó hírek

Élő avatárt kapott a Gemini 3.8 Live
Termékek és eszközök2026. szeptember 24.

Élő avatárt kapott a Gemini 3.8 Live

A Google DeepMind bemutatta a Gemini 3.8 Live with Live Avatar rendszert, amely valós idő közeli videógenerálással egészíti ki a hangalapú párbeszédet. A vállalat…

Új Gemini hangmodellek érkeztek egyedi beszédhangokhoz
Modellek2026. szeptember 23.

Új Gemini hangmodellek érkeztek egyedi beszédhangokhoz

Két új szövegfelolvasó modellel bővül a Gemini család: a Gemini 3.8 Flash TTS a kreatív hangtervezésre, a Gemini 3.8 Flash-Lite TTS pedig nagy volumenű használatra…

A Google bemutatta a Gemini 3.8 Live hangalapú AI-modelleket
Modellek2026. szeptember 15.

A Google bemutatta a Gemini 3.8 Live hangalapú AI-modelleket

A Google bemutatta a Gemini 3.8 Live és a Gemini 3.8 Live Extended Thinking modelleket, amelyek természetesebb hangalapú párbeszédet, valós idejű vizuális értelmezést és…