Vízjelet kapnak a jövőbeli Claude-modellek szöveges válaszai

Az Anthropic 2026. augusztus 14-én ismertette, hogyan működik majd a jövőbeli Claude-modellek szöveges vízjele. A cég szerint a megoldás az EU AI Act miatt érkezik, és annak valószínűségét segít megállapítani, hogy Claude részt vett-e egy szöveg megírásában.
- A jövőbeli Claude-modellek szöveges vízjelet használnak az Anthropic szerint.
- A változtatás célja az EU AI Act követelményeinek való megfelelés.
- A vízjel nem látható, nem ad rejtett karaktereket, és nem igényel extra tokeneket.
- A módszer a Google DeepMind SynthID-Text megközelítésének egy változata.
- A felismerés rövid, tényközpontú, lektorált vagy kód jellegű szövegeknél korlátozottabb lehet.
Mit vezet be az Anthropic?
Az Anthropic közlése szerint a jövőbeli Claude-modellek olyan szöveget fognak generálni, amely vízjelet tartalmaz. Ez nem látható jelölés: a cég azt írja, semmit nem adnak hozzá a szöveghez, nincsenek rejtett karakterek, és az olvasók nem tudják majd megkülönböztetni a vízjeles és a vízjel nélküli választ.
A cél annak becslése, mekkora a valószínűsége annak, hogy Claude részt vett egy adott szöveg megírásában. Az Anthropic szerint a vízjel nem hordoz azonosító információt, és nem vezethető vissza konkrét személyre, szervezetre vagy beszélgetésre.
A vállalat a változtatást az EU AI Act követelményeivel magyarázza. A közlemény szerint augusztus 2-től az EU megköveteli, hogy a piacát kiszolgáló AI-szolgáltatók megjelöljék az AI által generált tartalmakat. Az Anthropic azt is írja, hogy más nagy modellfejlesztők ugyanazt a Code of Practice dokumentumot írták alá, és saját vízjeleket fognak bevezetni.
Hogyan működik a szöveges vízjel?
A nagy nyelvi modellek, köztük Claude, a következő szót mindig az előzmények alapján választják ki a lehetséges jelöltek közül. Az Anthropic magyarázata szerint sok olyan helyzet van, amikor több szó is hasonlóan megfelelő lenne, és az olvasó számára a jelentés lényegében ugyanaz marad.
A vízjel ezeket az alacsony tétű döntéseket használja fel. A választás továbbra is véletlenszerű, de a véletlenszerűség forrása megváltozik: egy kulcs és a megelőző néhány szó segít eldönteni, melyik szó kerüljön a válaszba. Így a szövegben olyan minta jön létre, amely az olvasó számára nem érzékelhető, de a megfelelő kulccsal vizsgálható.
Az Anthropic hangsúlyozza, hogy ez nem kényszeríti Claude-ot olyan szavak választására, amelyeket egyébként nem venne számításba. A vállalat példája szerint a módszer nem tolná a modellt olyan ritka szó felé, mint a „nubilous”, amely az „overcast” vagy „grey” homályos szinonimája.
Milyen módszerre épül?
A Claude szöveges vízjele az Anthropic szerint a Google DeepMind által 2024-ben, egy Nature-tanulmányban publikált SynthID-Text megközelítés egyik változata. A cég azt írja, ez olyan módszercsaládba tartozik, amely Scott Aaronson 2022-es javaslatáig vezethető vissza.
Az Anthropic belső tesztjei alapján a vízjel nincs hatással Claude szövegének tartalmára, kreativitási szintjére vagy olvashatóságára. A közlemény a SynthID-Text tanulmányra is hivatkozik: a Google DeepMind a módszert Gemini-forgalom egy részén tesztelte, majd a pozitív és negatív értékeléseket hasonlította össze, és nem talált statisztikailag szignifikáns eltérést a vízjel nélküli modellhez képest. Egy kontrollált vizsgálatban az emberi értékelők sem láttak minőségi különbséget a vízjeles és a vízjel nélküli válaszok között.
A módszernek vannak korlátai. A kulccsal csak arra lehet választ keresni, mekkora a valószínűsége annak, hogy a szöveget részben Claude írta. Nem igazolja, hogy egy szöveg emberi eredetű, és azt sem mondja meg, ha egy másik AI írta.
Mit jelent ez a felhasználóknak?
Az Anthropic szerint a vízjel nem lassítja érdemben a modelleket, és mivel nem hoz létre extra tokeneket, a kiszolgálás és a használat ára változatlan marad. A cég állítása szerint a vízjel gyakorlati hatással nincs Claude válaszainak minőségére vagy tartalmára.
A felismerhetőség a szöveg hosszától és jellegétől függ. Rövid mintákon a vízjel kevésbé működik jól, mert kevesebb döntési pont áll rendelkezésre. Tényközpontú szövegekben is ritkább lehet, ha a pontosság miatt kevés a valódi választási lehetőség. Az Anthropic példája szerint az „Isaac Newton’s most famous work was called Principia …” mondatnál a következő szónak a „Mathematica” a helyes folytatása, ezért a vízjelnek nincs min működnie.
Hasonló a helyzet lektorálásnál és kódnál. Ha Claude csak nyelvtant és központozást javít egy ember által írt szövegben, a vízjel legfeljebb a kevés módosításon jelenhet meg. Kód esetében, ahol sokszor pontos kimenetre van szükség, általában kevesebb a vízjel, bár például kódbeli megjegyzésekben lehetnek olyan szabadabb választások, ahol a módszer alkalmazható.
Anthropic: How Claude's text watermarking works
