Az OpenAI bejelentette, hogy láthatatlan vízjelet vezet be a következő által generált, erre alkalmas szövegekben: ChatGPT és Codex az Európai Unióban. Az október 5-i bejelentés szerint a bevezetés a következő hetekben, minden csomagban megkezdődik. Az intézkedés célja az MI által generált tartalom azonosítására vonatkozó európai előírások teljesítése; a saját munkaként beadott MI-szövegek esetében magyar diákokat és hallgatókat is érinthet. Az API-ügyfelek bizonyos modelleknél már bekapcsolhatják a jelölést, de az alapértelmezés szerint ki van kapcsolva.
A technológia neve „textGrain”, és statisztikai mintázatot épít a modell szóválasztásaiba. Egyszerűbben: amikor a ChatGPT több lehetséges megfogalmazás közül választhat, a rendszer finoman befolyásolja a választást, hogy a megfelelő kulccsal rendelkező detektor később felismerhesse a jelet. Nincsenek rejtett karakterek, láthatatlan szóközök vagy gyanús írásjelek. A lenyomat a megfogalmazás része, ezért a szöveg egyszerű bemásolása egy dokumentumba elvileg megőrzi a mintázatot.

A felismerésnek ugyanakkor fontos korlátai vannak. Pszichológiai témájú szövegeken végzett tesztekben a rendszer a 200 tokenes részletek körülbelül 80%-át, a 400 tokenesek 95%-át azonosította, 1%-os célzott téves pozitív arány mellett. A tokenek olyan szövegegységek, amelyek szavakat vagy szótöredékeket is jelenthetnek. Matematikai szövegeknél gyengébbek voltak az eredmények, a szerkesztés pedig jelentősen rontotta az észlelhetőséget. Ezek ellenőrzött vizsgálatokból származó adatok, így nem garantálják ugyanezt a pontosságot minden témában, nyelven vagy dokumentumtípusnál.
Az oktatók számára a detektorhoz való hozzáférés legalább olyan fontos lesz, mint maga a technológia: az eszköz induláskor nem lesz nyilvánosan elérhető, csak jóváhagyott kutatók és szakosodott szervezetek használhatják. Ráadásul a vízjel felismerése nem mondja meg, ki használta a ChatGPT-t, mekkora volt az emberi szerző hozzájárulása, illetve történt-e szabálysértés. A rendszer ember által írt, majd MI-vel átdolgozott szöveget is jelezhet. A korábban, e lenyomat nélkül generált anyagok sem válnak automatikusan felismerhetővé a textGrainnel. A jel hiánya pedig önmagában nem bizonyítja, hogy a szöveget teljes egészében ember írta.




