Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Az Inworld AI felvásárolta a valós idejű hangügynököket fejlesztő Ultravoxot

2026. szeptember 30.Forrás: Inworld AI
Az Inworld AI felvásárolta a valós idejű hangügynököket fejlesztő Ultravoxot
Kép: Inworld AI

Az Inworld AI felvásárolta az Ultravoxot, a valós idejű hangügynökök fejlesztésére használt platformot. Az Ultravox csapata az Inworldnél folytatja a platform fejlesztését, az első változás pedig már elérhető az ügyfelek számára.

A lényeg röviden
  • Az Inworld AI felvásárolta a valós idejű hangügynökökhöz használt Ultravox platformot.
  • Az Ultravox csapatának csatlakozott tagjai az Inworldnél folytatják a fejlesztést.
  • Az Ultravox beépített Inworld-hangjai már a Realtime TTS-2 modellen futnak.
  • A meglévő hangazonosítók működnek, migrációra és kódmódosításra nincs szükség.
  • A TTS-2 frissítése és a természetes nyelvű hangvezérlés külön díj nélkül érhető el.

A beszédértést és a hanggenerálást egyesítenék

Az Inworld AI szeptember 30-án jelentette be az Ultravox felvásárlását. A két vállalat korábban szövegfelolvasási együttműködésben dolgozott együtt, és közös céljuk a nagy léptékben működő, valós idejű mesterséges intelligencia fejlesztése.

Az Inworld közlése szerint az Ultravox a beszéd megértésében, a következtetésben és a feladatok végrehajtásában rendelkezik tapasztalattal. A platform eszközöket kínál az élő beszélgetésekben szükséges beszédváltás és a közbeszólások kezeléséhez is. Az Inworld ehhez beszédmodelleket, modellkiszolgálást és valós idejű következtetési infrastruktúrát biztosít fogyasztói AI-alkalmazásokhoz.

A vállalat szerint a technológiák összevonása javíthatja a teljes beszélgetési folyamatot: a rendszer megértheti, amit a felhasználó mond, segíthet a feladat elvégzésében, majd a helyzethez illő hangon válaszolhat. Az Inworld a fejlesztők számára a jövőben jobb beszéd-beszéd élményeket ígér, miközben az Ultravox hangjai és képességei is tovább fejlődnek.

Az Ultravox hangjai már a TTS-2 modellen futnak

Az első változás már elérhető: az Ultravoxba beépített Inworld-hangok mostantól a Realtime TTS-2 modellen futnak. Ha egy ügynök korábban ilyen hangot használt, a frissítés automatikusan megtörtént. A meglévő hangazonosítók továbbra is működnek, így ehhez nincs szükség kódmódosításra.

Az Inworld szerint a TTS-2 az Artificial Analysis rangsorában élmezőnybe tartozó hangmodell. A modell természetes nyelvű vezérlést is kínál, amellyel a fejlesztők meghatározhatják az ügynök beszédtempóját, hangszínét és érzelmi előadásmódját. Például kérhetik, hogy egy összetett lépés magyarázatakor lassabban beszéljen, ügyfél megnyugtatásakor melegebb hangot használjon, vagy egy karakter megszólalásakor energikusabb legyen.

A beszélő személyazonossága változatlan marad, a frissített modell mellett azonban eltérhet a tempó és a hanglejtés. A vezérlés használata opcionális, ezért a fejlesztők csak azokban a helyzetekben alkalmazhatják, ahol szükségük van rá.

Az ügyfeleknek nincs teendőjük

Az Inworld tájékoztatása szerint a meglévő Ultravox-ügynökök a megszokott módon működnek tovább. A felvásárlás részeként nincs szükség migrációra vagy kódmódosításra, a TTS-2-re történő frissítés pedig külön díj nélkül érhető el.

Azoknál, akik más szolgáltató hangját használják, jelenleg nem történik változás. Ők továbbra is meglévő fiókjukon keresztül használhatják az Ultravoxot, az Inworld és a platformot létrehozó csapat tagjainak támogatásával. A vállalat a következő hetekben további részleteket ígér a beszéd-beszéd képességekről és az Ultravox ügyfeleit érintő fejlesztésekről.

Zach Koch, az Ultravox társalapítója és korábbi vezérigazgatója szerint az Inworld a megfelelő hely a platform további fejlesztéséhez. Az Inworld közlése alapján a felvásárlás a fejlesztők számára folytatólagos platformhasználatot és új hangvezérlési lehetőségeket jelent, miközben az ügynökök működésében jelenleg nincs szükség átállásra.

Kapcsolódó hírek

A Microsoft új, valós idejű átírómodellt és hangmodelleket mutatott be
Modellek2026. október 1.

A Microsoft új, valós idejű átírómodellt és hangmodelleket mutatott be

A Microsoft bemutatta első folyamatos átírásra készült modelljét, a MAI-Transcribe-2-Streaminget, amely a cég szerint az Artificial Analysis rangsorában az első helyen…

Az Inworld új hangmodellje a beszéd természetes ritmusát utánozza
Modellek2026. augusztus 31.

Az Inworld új hangmodellje a beszéd természetes ritmusát utánozza

Az Inworld bemutatta a Realtime TTS-2 hangmodellt, amely a beszéd természetesnek ható részleteire épít, például a töltelékszavakra, a szünetekre és az önkorrekciókra. A…

Nyílt forrású eszközt adott ki a TTS-rendszerek összehasonlítására az Inworld
Fejlesztőknek2026. augusztus 28.

Nyílt forrású eszközt adott ki a TTS-rendszerek összehasonlítására az Inworld

Az Inworld nyílt forrású eszköztárat mutatott be a szövegfelolvasó, vagyis TTS-rendszerek reprodukálható és részletes vizsgálatához. A keretrendszer hangmintákat készít…