A LiveKit szerint minden modellnél alapértelmezett a ZDR

A LiveKit közlése szerint a LiveKit Inference szolgáltatáson keresztül elérhető minden LLM, STT és TTS modell zero data retention, vagyis nulla adatmegőrzés mellett működik. A beállítás minden csomagban alapértelmezett, ezért a felhasználóknak nem kell külön kapcsolót aktiválniuk vagy magasabb csomagra váltaniuk.
- A LiveKit Inference minden LLM, STT és TTS modelljénél alapértelmezett a ZDR.
- A beállítás minden LiveKit csomagra érvényes, külön kapcsoló nélkül.
- A nem megfelelő adatvédelmi feltételeket kínáló beszállítók nem kerülnek be a platformra.
- Az Agent observability adatai 30 nap után automatikusan törlődnek.
- A hangklónozáshoz tárolt hangminta az utolsó használat után 12 hónappal törlődik.
A ZDR célja a teljes modellstackben
A LiveKit augusztus 13-i blogbejegyzése szerint a vállalati ügyfelek biztonsági ellenőrzésein gyakran felmerül a kérdés, hogy egy hangalapú ügynök minden modellbeszállítója alkalmazza-e a zero data retention, röviden ZDR elvet. A cég szerint a szolgáltatók ezt eltérő módon kezelik: egyesek űrlapot és emberi jóváhagyást kérnek, mások fizetős csomaghoz, irányítópulthoz vagy külön beállításhoz kötik.
A LiveKit értelmezésében a ZDR azt jelenti, hogy az adatokat a szolgáltatás teljesítésén túl nem őrzik meg, nem használják modelltréningre, és nem alkalmazzák olyan célra, amelyet a felhasználó nem választott. A vállalat négy követelményt emel ki: nincs megőrzés, naplózás, tréning és összesítés. A LiveKit szerint ez minden, a platformon elérhető szolgáltatásra és modellre vonatkozó elv.
Minden Inference modellnél automatikus a védelem
A közlés szerint a LiveKit Inference minden LLM, STT és TTS modellje nulla adatmegőrzéssel és a felhasználói adatokon végzett tréning nélkül van konfigurálva. Ez az összes LiveKit csomagra érvényes. Nincs szükség külön paraméterre, csomagváltásra vagy irányítópulti beállításra, a ZDR a kiválasztott modellazonosító tulajdonsága.
A LiveKit példakódjában a Deepgram flux-general modellje végzi a beszédfelismerést, a Google gemma-4-31b-it modellje a nyelvi feldolgozást, az Inworld inworld-tts-2 modellje pedig a beszédszintézist. A cég hangsúlyozza, hogy a kódban nincs külön ZDR kapcsoló.
A háttérben a LiveKit kezeli a beszállítói szerződéses vállalásokat, a szükséges jóváhagyásokat, a fiók vagy munkaterület beállításait, valamint az egyes kérésekhez szükséges paramétereket. A vállalat szerint azok a külső szolgáltatók, amelyek nem tudják teljesíteni a megőrzés, naplózás, tréning és rendszerfejlesztés kizárását, nem érhetők el a LiveKiten keresztül.
Három funkció adatot tárol, de meghatározott célból
A LiveKit szerint a ZDR az egész folyamatban érvényesül, a belépési ponttól a modellbeszállítón át az infrastruktúráig. Minden új modell megjelenése előtt ellenőrzik, hogy megfelel-e a vállalat követelményeinek, a meglévő integrációkat pedig folyamatosan vizsgálják a gyártási környezetben.
Három olyan funkció van, amelynek működéséhez szükséges az adatmegőrzés. Az Agent observability a hibakereséshez 30 napig tárolja a leiratokat és hangfelvételeket, majd automatikusan törli őket. Az Egress a munkameneteket az ügyfél saját felhőtárhelyére rögzíti, ahol az ügyfél szabályozza a megőrzési időt. A LiveKit köztes fájljai a feltöltés után azonnal törlődnek.
A hangklónozás a hangmintát addig tárolja, amíg a klón új szolgáltatókkal is működni tud. A LiveKit szerint a minta az utolsó használat után 12 hónappal törlődik, vagy azonnal, ha a felhasználó törli a klónt. A cég állítása szerint ezekben az esetekben sincs modelltréning, adatmegosztás vagy más célú felhasználás.
LiveKit: How we handle Zero Data Retention (ZDR) in LiveKit


