Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Gyors döntési modellt tesztelt a Vapi a hangalapú AI biztonságára

2026. szeptember 23.Forrás: Vapi
Gyors döntési modellt tesztelt a Vapi a hangalapú AI biztonságára
Kép: Vapi

A Vapi a TypeSafe AI korai hozzáférésű Jev modelljét tesztelte arra, hogy a hangalapú AI-asszisztensek válaszai megszegnek-e egy előre megadott szabályt. A modell gyors döntési ellenőrzésként működhet, de a vállalat szerint nem garantál teljes körű megfelelést.

A lényeg röviden
  • A Jev strukturált döntéseket ad, például pontszámot vagy igen, nem valószínűséget.
  • A Vapi a beszédgenerálással párhuzamos válaszellenőrzésre tesztelte.
  • Egy korai tesztben legalább négyből három szabályszegő választ felismert.
  • A modell nem jelent százszázalékos megfelelési garanciát.
  • A szabályok megfogalmazása és a reprezentatív tesztelés kulcsfontosságú.

A Jev strukturált döntéseket ad

A Vapi szeptember 23-án közzétett beszámolója szerint a Jevet a TypeSafe AI csapata fejlesztette. A modell a TypeSafe AI korai hozzáférésű, „System One” modellje, amely nem hosszabb szövegeket állít elő, hanem kontextus és célzott kérdések alapján strukturált döntéseket ad. Ilyen eredmény lehet egy pontszám vagy egy igen, illetve nem valószínűség.

A Vapi kutatásával foglalkozó Ashwin Alaparthi szerint a Jev sebessége és kontextuskezelése különösen érdekessé tette a hangalapú AI számára. A Vapi valós idejű rendszere beszédfelismerést, nyelvi modelleket, hanggenerálást és eszközöket kapcsol össze. Ebben a folyamatban sok kisebb döntés történik, amelyek hatással lehetnek a válasz sebességére és működésére.

Külön ellenőrzés a kimondás előtt

Az első kísérlet egy úgynevezett védelmi ellenőrzésre, guardrailre épült. A fejlesztő meghatározott egy szabályt, a Jev pedig azt értékelte, hogy a hangalapú asszisztens kimondásra készülő válasza megszegi-e ezt a szabályt. Példaként a Vapi azt említi, hogy az asszisztens ne adjon orvosi tanácsot.

A szabályok továbbra is elsősorban a rendszerutasításokban jelennek meg, de a Vapi szerint egy utasítás figyelmen kívül maradhat, ha helytelenül fogalmazták meg, vagy túl hosszúvá vált a kontextus. A Jev külön ellenőrzésként, a beszédgenerálással párhuzamosan futhat, ha gyorsabban válaszol, mint amennyi idő alatt a rendszer előállítja a hangot.

Az egyik korai tesztben a Jev legalább négyből három, az értékelt szabályt megszegő választ felismert. A Vapi hangsúlyozza, hogy ez nem százszázalékos megfelelési garancia, hanem egy további ellenőrzési réteg.

A szabályok megfogalmazása és a téves riasztások is számítanak

A kísérletek szerint a szabályok pontos megfogalmazása alapvető. A Vapi azt javasolja, hogy a fejlesztők rövid és egyszerű utasításokkal kezdjenek. Ha több műveletet kell tiltani, célszerű mindegyiknél megismételni az igét. Az „Ne ajánlj gyógyszert, ne ajánlj adagot, ne ajánlj eljárást” típusú megfogalmazás pontosabban a tiltott cselekvésre irányítja az ellenőrzést, mint egy puszta főnévi felsorolás.

A válaszokat vizsgáló osztályozó olyan szabályoknál lehet hasznos, amelyek az asszisztens által kimondott tartalomra vonatkoznak, a teljes beszélgetés során érvényesek, és a válasz alapján elbírálhatók. Nem tudja megállapítani például, hogy az asszisztens a megfelelő eszközt hívta-e meg, ha nem látja az eszköz állapotát. Egy tudásbázissal sem tud állítást ellenőrizni, ha annak tartalmát nem kapta meg.

A téves riasztások különösen fontosak hangalapú rendszereknél, mert a megszakítást a hívó fél is hallja. A Vapi szerint az aktív használat előtt reprezentatív értékelési adathalmazon kell tesztelni a szabályokat. A Jev a vállalat szerint más területeken is vizsgálható, például hangposták felismerésére vagy annak eldöntésére, hogy a hívó befejezte-e a beszédet. Ezek egyelőre csak feltevések, további kísérletekre van szükség.

Kövesd az AI Hírek oldalát a FacebookonA legfontosabb MI-hírek magyarul, rögtön a megjelenés után a hírfolyamodban.Követem

Kapcsolódó hírek

OpenAI döntési API-t mutatott be, de a részletek még hiányoznak
Cégek és üzlet2026. szeptember 30.

OpenAI döntési API-t mutatott be, de a részletek még hiányoznak

Az OpenAI Decisions API-ja előre meghatározott válaszok közül választva segítheti az ügynökök vezérlését. A korlátozott előzetes hozzáférés már elérhető egyes…

A Jev 3,5-szer olcsóbb és 3,8-szer gyorsabb bírómodellnek bizonyult
Modellek2026. szeptember 30. 00:11

A Jev 3,5-szer olcsóbb és 3,8-szer gyorsabb bírómodellnek bizonyult

A TypeSafe AI Jev modellje 1000 valódi termelési interakción 3,5-szer olcsóbbnak és mediánban 3,8-szer gyorsabbnak bizonyult, mint a Comet által használt gpt-4o-mini…

A Jev 3,8-szor gyorsabb és 3,5-szer olcsóbb bírómodellnek bizonyult
Modellek2026. szeptember 30. 00:11

A Jev 3,8-szor gyorsabb és 3,5-szer olcsóbb bírómodellnek bizonyult

A TypeSafe AI Jev modellje 1000 valós termelési fordulaton 3,5-szer olcsóbb és 3,8-szor gyorsabb volt, mint a Comet által használt gpt-4o-mini bírómodell. A két modell…