Az OpenAI vízjelet vezet be az EU-s ChatGPT-szövegekben
Az OpenAI fokozatosan bevezeti a láthatatlan szöveges vízjelet az Európai Unióban használt, jogosult ChatGPT- és Codex-kimenetekben. A vállalat szerint a technológia még korlátozottan megbízható, ezért a detektort kezdetben csak jóváhagyott kutatók és szakértő szervezetek használhatják.
- Az EU-ban a következő hetekben láthatatlan vízjel kerülhet a jogosult ChatGPT- és Codex-szövegekbe.
- Az API ügyfelei világszerte bekapcsolhatják a vízjelezést bizonyos modelleknél.
- A textGrain a modell szóválasztásaiba épít láthatatlan statisztikai jelet.
- A szerkesztés, a fordítás és a rövid szöveg megnehezítheti a felismerést.
- A detektorhoz kezdetben csak jóváhagyott kutatók és szakértő szervezetek férhetnek hozzá.
Az EU-ban indul a ChatGPT és a Codex vízjelezése
Az OpenAI 2026. október 5-én ismertette megközelítését az uniós mesterségesintelligencia-szabályozással kapcsolatban. Az EU AI Act előírja, hogy a generatív AI-szolgáltatók géppel olvasható módon azonosíthatóvá tegyék a generált szövegeket.
A vállalat a következő hetekben láthatatlan vízjelet ad a jogosult ChatGPT- és Codex-szövegekhez az Európai Unióban. A bevezetés minden uniós csomagra kiterjed, az OpenAI ugyanakkor induláskor nem teszi globális alapértelmezetté a funkciót. A regionális bevezetés lehetőséget ad a vállalatnak arra, hogy valós használati tapasztalatokat és visszajelzéseket gyűjtsön.
Az API ügyfelei világszerte már most bekapcsolhatják a szöveges vízjelezést bizonyos modelleknél. Az API-ban a funkció alapértelmezés szerint kikapcsolva marad. Az OpenAI felhőpartnereivel is dolgozik azon, hogy a szolgáltatásaikon keresztül elérhető modellkimeneteknél a következő hetekben szintén elérhető legyen a vízjelezés.
Statisztikai jelet keres a textGrain
Az OpenAI technológiája, a textGrain, láthatatlan statisztikai jelet épít be a modell szóválasztásaiba. A hozzá tartozó detektor azt vizsgálja, hogy egy szövegrész tartalmazza-e ezt az OpenAI-vízjelet. A vállalat szerint a textGrain a saját értékeléseiben elérte vagy meghaladta az összehasonlításként vizsgált megoldások, köztük a SynthID for text teljesítményét.
Az OpenAI hangsúlyozza, hogy az ideális körülmények között mért jó eredmény nem garantál megbízható felismerést a mindennapi használatban. A detektor tévesen jelezhet vízjelet, ez a hamis pozitív eredmény, illetve elmulaszthatja a meglévő jelet, ez a hamis negatív eredmény.
Az értékelésben 1 százalékos célzott hamispozitív arány mellett a rendszer pszichológiai témájú, 200 tokenes szövegrészek körülbelül 80 százalékában azonosította a vízjelet. 400 tokennél ez az arány körülbelül 95 százalék volt. Matematikai tartalmaknál a felismerés lényegesen gyengébbnek bizonyult, mivel ezekben kisebb a szóválasztás szabadsága.
A szerkesztés szintén gyengíti a jelet. 400 tokenes szövegekben a szavak 10 százalékának szinonimákra cserélése körülbelül 92 százalékról 66 százalékra csökkentette a felismerést. A 25 százalékos csere 17 százalékra vitte le az arányt.
A vízjel nem bizonyítja a szerzőséget vagy a pontosságot
Az OpenAI szerint a vízjel csak korlátozott jelzést adhat arról, milyen szerepet játszottak a vállalat rendszerei egy szövegrész létrehozásában. Nem mutatja meg, mekkora emberi hozzájárulás, szerkesztés vagy kreatív munka áll a szöveg mögött.
A jel nem állapítja meg a tulajdonjogot, a felhasználás jogszerűségét vagy a felelősséget, és nem azonosítja a felhasználót. Nem kapcsolja a szöveget személyhez, szervezethez, fiókhoz, prompthoz vagy beszélgetéshez. Azt sem jelzi, hogy a szöveg igaz, félrevezető, káros vagy megfelelő kontextusban szerepel-e.
A vízjel hiánya sem bizonyítja az emberi szerzőséget. A felismerést megnehezítheti a rövid terjedelem, a szerkesztés vagy a fordítás. A szöveg készülhetett olyan modellel is, amelyet a rendszer nem támogatott, a vízjelezés bevezetése előtt, vagy más vállalat eszközével.
A detektorhoz egyelőre korlátozott hozzáférés jár
Az OpenAI megnyitotta a jelentkezést a szövegesvízjel-detektor használatára. Kezdetben jóváhagyott kutatók és szakértő szervezetek kaphatnak hozzáférést, eseti elbírálás alapján. A cél a technológia megbízhatóságának és felelős alkalmazásának vizsgálata, valamint a rendszer továbbfejlesztése.
A detektor csak arról ad visszajelzést, hogy észlel-e OpenAI-vízjelet. Nem azonosítja a felhasználót, és nem tárja fel a promptokat vagy a beszélgetéseket. A vállalat a kihagyott vízjelek és a téves riasztások kockázata miatt induláskor nem teszi nyilvánosan elérhetővé az eszközt.
Az OpenAI a textGrain technológiát később nyílt forráskódúvá is tenné. A vállalat folytatja annak vizsgálatát, hogyan áll ellen a vízjel a szerkesztésnek és a fordításnak, illetve miként lehetne érdemben megkülönböztetni az AI-segítséget az AI-szerzőségtől.
A szöveges megoldás az OpenAI tágabb tartalomeretűségi megközelítésének része. A vállalat támogatott képkimeneteknél Content Credentials adatokat használ, C2PA-konform, valamint bizonyos képekbe és hangokba láthatatlan SynthID-vízjeleket épít. A képek és hangok ellenőrzésére szolgáló openai.com/verify webes eszköz és a Content Provenance API továbbra is nyilvánosan hozzáférhető marad az ilyen fájlokat vizsgáló szervezetek számára.
OpenAI: Our approach to EU text provenance rules
