Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A Speechmatics beszédfelismerése már 8000 alkalmazással köthető össze a Zapieren

2026. augusztus 12.Forrás: Speechmatics
A Speechmatics beszédfelismerése már 8000 alkalmazással köthető össze a Zapieren
Kép: Speechmatics

A Speechmatics beszédfelismerő szolgáltatása megjelent a Zapieren, így a felhasználók kódolás, saját szerver és külön API-kliens nélkül kapcsolhatják össze több mint 8000 alkalmazással. Az integráció jelenleg béta állapotú, és kétféle műveletet kínál.

A lényeg röviden
  • A Speechmatics megjelent a Zapieren, több mint 8000 alkalmazással kínálva kód nélküli összekapcsolást.
  • A Get Transcript from Audio szinkron, a Submit Audio (Webhook) aszinkron feldolgozást biztosít.
  • Beállítható a beszélők elkülönítése, valamint a szöveges, JSON- és SRT-kimenet.
  • A Batch API miatt a Melia modell több mint 56 nyelven kezeli a kódváltást.
  • Az integráció jelenleg béta állapotú, natív „átirat elkészült” indítóesemény még nincs.

Kétféle módon kérhető le az átirat

A Speechmatics 2026. augusztus 12-i bejelentése szerint az integráció a Zapier automatizációs platformján keresztül teszi elérhetővé a vállalat beszédből szöveget készítő motorját. A cél, hogy a felhasználóknak ne kelljen webhookokat, lekérdező szkripteket vagy egyedi végpontokat írniuk ahhoz, hogy egy hangfelvétel átirata eljusson például egy csevegőcsatornába, ügyfélkapcsolat-kezelő rendszerbe vagy jegykezelőbe.

A Zapierben két művelet közül lehet választani. A Get Transcript from Audio szinkron módon működik: a felhasználó megad egy hangfájlhoz tartozó URL-t, a rendszer pedig ugyanazon a Zapon belül visszaadja az átiratot. Ezt rövidebb hanganyagokhoz szánják, amikor a következő lépésnek azonnal szüksége van a szövegre.

A Submit Audio (Webhook) hosszabb fájlokhoz készült. Ilyenkor a hangfájl URL-je és egy webhook URL-je kerül a műveletbe, a Speechmatics pedig a feldolgozás befejezése után elküldi a kész átiratot a megadott címre. Mivel jelenleg nincs külön, natív „átirat elkészült” indítóesemény, ehhez egy második, kapcsolódó Zapra van szükség, amely fogadja a POST-kérést, majd folytatja a munkafolyamatot.

Diarizálás és többféle kimeneti formátum

A két műveletben beállítható a beszélők elkülönítése, vagyis a diarizálás. Ez a funkció a szöveget beszélők szerint választja szét, így a későbbi alkalmazások azt is megkaphatják, hogy az egyes mondatokat ki mondta.

A kimenet háromféle formátumban kérhető: egyszerű szövegként, JSON-ként vagy SRT-feliratként. A forrás szerint a JSON szó szintű időzítést és megbízhatósági értéket is tartalmaz. Az SRT-formátumot például videók feliratozási folyamatába lehet továbbítani.

A beállítás a Speechmatics leírása alapján rövid folyamat: a felhasználó a kiváltó eseményből származó fájl-URL-t az Audio URL mezőhöz kapcsolja, kiválasztja a diarizálást és a kimeneti formátumot, teszteli a lépést, majd közzéteszi a Zabot. A vállalat szerint a Zapier-integráció a Batch API-n fut.

Meetingek, ügyfélszolgálat és tartalomgyártás

A Speechmatics több lehetséges felhasználási területet sorol fel. Egy Zoom-, Google Meet- vagy Teams-felvétel automatikusan átírható, majd az összefoglaló Slackbe, Google Dokumentumba vagy Notion-oldalra küldhető. Értékesítési hívások átiratai a vállalat szerint hozzáadhatók a megfelelő HubSpot- vagy Salesforce-rekordhoz.

Tartalomgyártásnál egy podcast vagy webinár felvétele átirattá alakítható, amelyből WordPressben vagy más tartalomkezelőben készülhet bejegyzésvázlat, illetve közösségi médiás részlet. Videófeltöltés után az SRT-kimenet automatikusan csatolható a videóhoz.

Az integráció ügyfélszolgálati, megfelelési és kutatási munkafolyamatokban is használható. A támogatási hívások beszélőcímkékkel kerülhetnek Zendeskbe vagy Intercomba, a pénzügyi, egészségügyi és jogi területen dolgozó csapatok pedig kereshető átiratokat archiválhatnak Drive-ban vagy SharePointban. A felhasználói interjúk Notionba, Airtable-be vagy kutatási adatbázisba továbbíthatók.

A Melia a többnyelvű felvételeket célozza

A Zapier-integráció a Speechmatics Batch API-ját használja, ezért a vállalat Melia modellje is elérhető benne. A Speechmatics szerint a modell az általuk támogatott több mint 56 nyelven képes kezelni a kódváltást, amikor egy beszélgetés közben a résztvevők egyik nyelvről a másikra váltanak.

A cég példaként olyan felvételt említ, amelyben az angol, a spanyol és a mandarin váltakozik. Ilyenkor a rendszer egy folyamatos átiratot készít, előzetesen kiválasztott nyelv vagy külön, nyelvenkénti modell használata nélkül. A Speechmatics ezt különösen globális ügyfélszolgálatok, többnyelvű műsorok feliratozása és több piac hívásait ellenőrző megfelelési csapatok számára tartja fontosnak.

Az integráció béta állapotban van, ezért a részletek még változhatnak. A vállalat natív „átirat elkészült” indítóesemény bevezetését is jelezte, de ennek időpontját nem közölte.

Kapcsolódó hírek

A Speechmatics helyben futó beszédfelismerést kínál vállalatoknak
Cégek és üzlet2026. szeptember 24.

A Speechmatics helyben futó beszédfelismerést kínál vállalatoknak

A Speechmatics korai hozzáférést nyitott On-Device beszédfelismerő technológiájához, amely a hangot teljes egészében a felhasználó számítógépén dolgozza fel. A vállalat…

A Speechmatics új beszédfelismerője a hangalapú ügynököket célozza
Cégek és üzlet2026. szeptember 17.

A Speechmatics új beszédfelismerője a hangalapú ügynököket célozza

A Speechmatics bemutatta az Agent STT beszédfelismerő API-t, amelyet kifejezetten élesben működő hangalapú ügynökökhöz fejlesztett. A szolgáltatás mögött a Linden 1…

A Speechmatics szerint 20 másodperc alatt átír egyórányi hangot a Melia
Modellek2026. augusztus 26.

A Speechmatics szerint 20 másodperc alatt átír egyórányi hangot a Melia

A Speechmatics Melia beszédfelismerő modellje a cég szerint egyórányi hangfelvételt kevesebb mint 20 másodperc alatt ír át. Az Artificial Analysis független rangsorán…