A vízjel bevezetése révén az OpenAI megfelel majd az EU mesterséges intelligenciával kapcsolatos szabályozásának, amely előírja, hogy a modellek által generált szövegek tartalmazzanak egy géppel olvasható azonosítót, amely jelzi, hogy a tartalom AI-jal készült.

Az OpenAI maga is hangsúlyozza, hogy a technológia nem tévedhetetlen. A rövid, erősen kötött vagy utólag jelentősen átdolgozott szövegek esetében jóval nehezebb felismerni a vízjelet. A jelentős átírás, parafrazeálás vagy fordítás akár teljesen felismerhetetlenné is teheti a jelölést.
 

Egy kis belenyúlással csökkenthető a felismerési arány

A cég egyik tesztjében egy körülbelül 400 tokenes szöveg szavainak 10 százalékát szinonimákra cserélve a felismerési arány nagyjából 92-ről 66 százalékra esett. A szavak negyedének lecserélése után már csak 17 százalék körüli volt.

A vízjelből azt sem lehet megállapítani, hogy pontosan ki használta a ChatGPT-t, milyen utasítást adott neki, vagy a végleges szöveg mekkora részét írta, illetve szerkesztette ember. Fordítva is igaz: ha a detektor nem talál vízjelet, az önmagában nem bizonyítja, hogy a szöveget ember írta - írjaa 24.hu.
 

1

Ha pedig a chatbottal beszélgetünk, akkor figyeljünk arra, milyen adatokat ne adjunk meg neki. Az Elon University digitális kutatóközpontjának kutatói korábban ezeket az örökzöld tanácsokat fogalmazták meg:

- személyazonossághoz köthető információk, pl. lakcím, személyigazolvány-szám, jogosítványszám, valódi név. Ezek az információk ugyanis kiszivároghatnak, illetéktelen kezekbe kerülhetnek, legrosszabb esetben rosszindulatú személyek visszaélhetnek velük.
- Túlságosan intim, személyes információk például párkapcsolatokról, családi helyzetről, magánéletről. Ezeket az információkat nemcsak elraktározzák a chatbotok, hanem külső személyek is hozzájuk férhetnek, például bírósági végzés esetén (az USA-ban egészen biztosan).
- Egészségügyi adatok megosztása: ez egyrészt a fent is említett személyes adatok kiszivárgása miatt veszélyes, másrészt pedig az is előfordulhat, hogy az AI részinformációk alapján téves diagnózist, rossz tanácsot ad.
- Érzékeny munkahelyi, céges adatok, forráskódok, olyan információk, melyeket bizalmas szerződés véd. Ismét: ezek az adatok kiszivároghatnak, az AI-rendszer pedig tárolja ezeket.
- Pénzügyi információk: fizetési adatok, bankkártyák, adóbevallás, befektetési tanácsadás. Itt is ugyanazok a kockázatok merülnek fel, mint az egészségügyi adatokkal kapcsolatosan: egyrészt előfordulhat, hogy illetéktelen személyek férnek hozzá a fizetési adatainkhoz, másrészt pedig az AI olyan tanácsot adhat, amin az ember végeredményében pénzt veszít.

 

2