December 2-áig adott haladékot arra az Európai Unió az AI Act 50. cikke alapján a már piacon lévő generatív AI-szolgáltatások üzemeltetőinek, hogy az eszközeikkel létrehozott szövegeket felismerhetővé tegyék gépi úton. A mesterséges intelligenciáról szóló jogszabálynak megfelelni igyekvő OpenAI ennek okán a következő hetekben láthatatlan vízjelet vezet be a ChatGPT és a Codex által generált szövegeknél az EU-ban. A vállalat közlése szerint a változás minden felhasználót érint függetlenül attól, milyen ChatGPT-csomagot használ.
Az OpenAI egyelőre nem terjeszti ki a vízjelezést az egész világra, mert előbb az uniós bevezetéssel valós környezetben szeretné megvizsgálni, mennyire működik megbízhatóan a rendszer, és kíváncsi a felhasználók visszajelzéseire is. Az API platform ügyfelei ezzel szemben már most bekapcsolhatják a láthatatlan vízjeleket bizonyos modelleknél, de számukra továbbra is alapértelmezés szerint ki van kapcsolva.
A vállalat által alkalmazott technológia a textGrain névre hallgat, és nem egy szemmel felismerhető jelet helyez el a szövegben, hanem statisztikai mintázatot rejt el a modell szóválasztásaiban. Egy külön detektor pedig képes ezt a mintázatot keresni. Az OpenAI szerint saját tesztjei során a textGrain legalább olyan jól teljesített, mint a cég által vizsgált alternatív megoldások, köztük a Google szöveges SynthID rendszere. A vállalat a technológiát ráadásul nyílt forráskódúvá is szeretné tenni.
A módszer ugyanakkor messze nem tévedhetetlen. Az OpenAI mérései szerint egy százalékos hamis pozitív arány mellett egy 200 tokenes szövegrészben nagyjából 80 százalékos, 400 tokennél pedig körülbelül 95 százalékos eséllyel volt felismerhető a vízjel. Ha azonban a szöveg tíz százalékában szinonimákra cserélték a szavakat, a felismerési arány máris nagyot esett, 92-ről 66 százalékra. Amennyiben pedig minden negyedik szót átírtak, már 17 százalék volt a felismerési arány. Matematikai szövegeknél még gyengébb eredmények születtek, mivel ott jóval kevesebb lehetőség van a szabad szóválasztásra.
További fontos korlátja a vízjelnek, hogy nem árulja el, ki készítette a szöveget, nem méri, hogy mekkora rész származik embertől, és nem bizonyítja a tulajdonjogot vagy a tartalom pontosságát. Ha pedig nem található benne jelzés, abból sem következik automatikusan, hogy ember írta, hiszen a szöveg lehet túl rövid, átszerkesztett vagy lefordított, illetve származhat más AI-rendszerből. A rendszer kizárólag azt jelzi, hogy talál-e OpenAI-vízjelet, a felhasználó személyét és a hozzá tartozó promptokat nem fedi fel. Éppen ezért az OpenAI kezdetben csak jóváhagyott kutatóknak és szakmai szervezeteknek biztosít hozzáférést a detektorhoz.
Forrás: OpenAI