A Vapi megnyitotta a GPT-Live zárt bétatesztjét

A Vapi korlátozott bétatesztben tette elérhetővé az OpenAI GPT-Live beszédalapú modelljét, miközben megnyitotta a nyilvános várólistát is. A vállalat szerint a GPT-Live egyetlen modellben egyesíti a beszédfelismerést, a nyelvi feldolgozást és a beszédgenerálást.
- A Vapi megkezdte a GPT-Live korlátozott bétatesztjét.
- A platform nyilvános várólistát indított a korai hozzáféréshez.
- A GPT-Live egy modellben kezeli a beszédfelismerést, a feldolgozást és a beszédgenerálást.
- A Vapi szerint a GPT-Live és a moduláris hangalapú rendszerek egymás mellett használhatók.
- A béta résztvevői a meglévő eszközöket, telefonszámokat és teszteket is megtarthatják.
Korlátozott béta és nyilvános várólista
A Vapi szeptember 3-án jelentette be, hogy megkezdte a GPT-Live korlátozott bétatesztjét. A vállalat első körben kis számú ügyféllel dolgozik együtt, hogy a modellt saját rendszereikben éles használatra készítsék fel.
A korai hozzáféréshez nyilvános várólistát is indítottak. A feliratkozás nem garantálja a hozzáférést, de a Vapi szerint előrébb sorolja a csapatokat a későbbi bővítés során. A jelentkezőknek azt is érdemes megadniuk, mire használnák a modellt, mivel ez segítheti a prioritások kialakítását.
A Vapi közlése szerint a bétatesztet tudatosan fokozatosan bővítik, és a szélesebb körű elérhetőséget az elkövetkező hónapokra tervezik.
Egy modellben kezeli a beszélgetés három fő lépését
A hagyományos hangalapú ügynökök több elemből álló folyamatot használnak. Egy beszédfelismerő rendszer szöveggé alakítja a hívást, egy nagy nyelvi modell feldolgozza azt, majd egy hangmodell kimondja a választ.
A Vapi leírása szerint a GPT-Live ezzel szemben beszéd és beszéd közötti modell, amely mindhárom feladatot egyetlen rendszerben végzi el. Ez a vállalat szerint természetesebb párbeszédeket tesz lehetővé. A modell figyel akkor is, amikor beszél, kezeli a közbevetéseket, természetes szüneteket tart, és a beszélgetés közben is képes reagálni.
A különálló modellek közötti átadások elhagyása csökkentheti a fordulók közötti késleltetést. A Vapi szerint a GPT-Live közvetlenül a hang tónusát és hangsúlyát is feldolgozza, így ezek az információk nem vesznek el a beszéd szöveges átirattá alakításakor.
A vállalat külön kiemeli a nevek, számok és címek pontosabb rögzítésének lehetőségét. Ez olyan helyzetekben lehet fontos, mint a személyazonosság ellenőrzése vagy az ügyfélszolgálati hívások. A komplex eszközhívások és a delegált következtetés közben a beszélgetés tovább folytatódhat.
A meglévő Vapi-rendszerek mellett használható
A Vapi szerint a platformot kezdettől modellfüggetlenre tervezték. Az asszisztensek, az eszközök, a telefonszolgáltatások, a tesztelés és a megfigyelhetőség a modellrétegtől elkülönülten működnek. Emiatt a vállalat szerint egy új modell beillesztése konfigurációs változtatással megoldható, teljes migráció nélkül.
A bétában részt vevő csapatok a GPT-Live-ot ugyanazon a technológiai alapon futtathatják, mint a jelenlegi, több modellből álló ügynökeiket. A Vapi közlése alapján ehhez ugyanazokat az eszközöket, telefonszámokat és teszteket használhatják, így az új modell kipróbálásához nem kell újjáépíteniük a teljes rendszert.
A moduláris felépítés is megmarad
A GPT-Live megjelenése nem jelenti a moduláris folyamatok kivezetését a Vapiról. Ezeknél a megoldásoknál a fejlesztők külön választhatják ki a beszédfelismerő, intelligencia- és hangmodelleket, majd az egyes elemeket önállóan hangolhatják vagy cserélhetik.
A Vapi szerint sok éles használati esetben ma is a moduláris konfiguráció adja a legnagyobb kontrollt. A platformon ezért a két megközelítés egymás mellett lesz elérhető, és az ügyfelek ügynökenként dönthetik el, melyik architektúrát használják.
A felhasználók számára ez azt jelenti, hogy a GPT-Live kipróbálása a meglévő Vapi-eszközök mellett történhet, miközben továbbra is választható marad a különálló modellekből felépített rendszer. A korai hozzáférés iránt érdeklődő csapatok a Vapi GPT-Live várólistáján jelentkezhetnek.

