claude logo and app

Szóválasztási mintákba rejti a vízjelet a Claude

Az Anthropic részletesen bemutatta, hogyan jelöli majd a Claude által generált szövegeket. A vízjel apró szóválasztások statisztikai mintájából épül fel, rejtett karaktereket vagy azonosító adatokat nem ad a szöveghez. Felismerése csak valószínűsíti a Claude közreműködését.

Így működik a Claude szöveges vízjele

A nyelvi modellek lépésenként választják ki a következő szót vagy szórészletet. Sok esetben több, közel azonos jelentésű folytatás közül dönthetnek anélkül, hogy ez érdemben befolyásolná a válasz minőségét.

A Claude vízjele ezeket az alacsony tétű döntéseket használja fel. Egy titkos kulcs és a korábbi szavak alapján olyan mintát alakít ki, amely az olvasó számára érzékelhetetlen, megfelelő ellenőrző rendszerrel azonban felismerhető.

Az Anthropic a Google DeepMind által kidolgozott SynthID-Text módszer egy változatát alkalmazza. A cég szerint a megoldás nem lassítja a modellt, nem igényel több tokent, és a belső teszteken nem rontotta a szövegek olvashatóságát vagy kreativitását. A vízjelből a felhasználó, a szervezet vagy az adott beszélgetés sem azonosítható.

A kisebb javításokat túlélheti a jelölés

Az Anthropic magyarázata szerint a könnyű szerkesztés valószínűleg nem tünteti el teljesen a vízjelet. Egy minden szóra kiterjedő átírás viszont megszüntetheti az érzékelhető mintát.

A felismerés rövid, tényszerű szövegeknél kevésbé megbízható. Ezekben a modellnek kevesebb szabad választása van, ezért a vízjel is ritkább. Ha saját szövegeden csak helyesírási vagy nyelvtani javítást kérsz, előfordulhat, hogy nem keletkezik elegendő jelölés az MI közreműködésének kimutatásához.

A fordítás más eset, mert ott minden szót a Claude választ ki. A programkódban várhatóan kevesebb lesz a vízjel, hiszen a működő megoldás sokszor pontos kifejezéseket követel. A szabadabban megfogalmazható megjegyzésekben és elnevezésekben ugyanakkor megjelenhet a minta.

A vízjel továbbra sem bizonyítja a csalást

A felismerés azt mutathatja meg, hogy a Claude valószínűleg részt vett a szöveg létrehozásában vagy jelentős átdolgozásában. Nem állapítja meg, ki készítette az eredeti változatot, mekkora volt az emberi hozzájárulás, és történt-e szabályszegés. Más MI-modellek használatáról sem ad információt.

Az Anthropic hamarosan külön vízjel-felismerő API-t tervez kiadni. A munkahelyeknek és az oktatási intézményeknek ezért már most érdemes tisztázniuk, milyen MI-használatot engednek meg, és hogyan értékelik majd a találatokat. A bejelentés körüli felhasználói vitáról és az ebből következő etikai kérdésekről korábbi cikkünkben írtunk.

Kérjük, ellenőrizd a mező formátumát, és próbáld újra.
Köszönjük, hogy feliratkoztál.

vagyunk.hu hírlevél

Hozzászólás

Az e-mail címet nem tesszük közzé. A kötelező mezőket * karakterrel jelöltük