Láthatatlan vízjel kerül a ChatGPT szövegeibe az Európai Unióban

Hamarosan minden ChatGPT-vel írt szöveg hordoz majd egy szemmel nem látható jelet az Európai Unióban. Az OpenAI így tesz eleget az uniós MI-rendelet átláthatósági előírásának – a megoldás azonban korántsem csalhatatlan.
A cég bejelentése szerint a következő hetekben az EU-ban automatikusan vízjelet kapnak a ChatGPT és a Codex által előállított szövegek, mégpedig minden előfizetési szinten, az ingyenestől a fizetősig. A fejlesztők az API-n keresztül világszerte már most bekapcsolhatják a funkciót, ott viszont alapból ki van kapcsolva.
Miért éppen most?
A háttérben az uniós MI-rendelet (AI Act) áll. Az augusztus 2-án életbe lépett átláthatósági szabályok előírják, hogy a mesterséges intelligenciát fejlesztő cégek géppel felismerhető módon jelöljék meg az általuk generált tartalmakat. A képeknél és videóknál erre már vannak bevett megoldások, a szövegnél viszont eddig hiányzott a használható módszer.
Hogyan lehet láthatatlanul megjelölni egy szöveget?
A vízjel nem rejtett karakter és nem is metaadat, hanem magában a megfogalmazásban bújik meg. A textGrain nevű eljárás egy titkos kulcs alapján finoman befolyásolja, hogy a modell a lehetséges következő szavak közül melyiket választja. Az olvasó ebből semmit nem vesz észre, a szöveg természetesnek hat, egy erre készült detektor viszont ki tudja mutatni a szóválasztásban megbúvó mintázatot.
Mivel a jel a szavak sorrendjében és megválasztásában él, kimásolás és beillesztés után is megmarad. A módszert az OpenAI kutatói a Pennsylvaniai Egyetem és a Yale szakembereivel közösen dolgozták ki. A cég hangsúlyozza: a vízjel nem azonosítja az egyes felhasználókat, csak azt jelzi, hogy a szöveg az ő eszközükből származik.
Mennyire megbízható?
Az OpenAI maga is elismeri, hogy a rendszernek komoly korlátai vannak. A saját méréseik szerint:
- érintetlen szövegnél a felismerés nagyjából 92 százalékos;
- ha a szavak tizedét szinonimára cserélik, ez 66 százalékra esik;
- a szavak negyedének kicserélése után már csak 17 százalék marad.
Nehezen mutatható ki a vízjel a rövid szövegekben, a lefordított tartalmakban és a matematikai jellegű válaszokban is. A cég ezért külön figyelmeztet: attól, hogy egy szövegben nem található vízjel, még nem bizonyított, hogy ember írta.
Ki ellenőrizheti?
Egyelőre szinte senki. A detektorhoz csak jóváhagyott kutatók és szakmai szervezetek férhetnek hozzá, jelentkezés után, kiértékelési célból. Nyilvános ellenőrző eszköz tehát nincs: sem tanár, sem szerkesztő, sem megrendelő nem tudja majd maga lefuttatni a vizsgálatot.
Mit jelent ez a gyakorlatban?
Annak, aki a ChatGPT-t levélírásra, ötletelésre vagy vázlatkészítésre használja, semmi nem változik: a válaszok ugyanúgy néznek ki, mint eddig. A vízjel nem tiltja meg a szöveg felhasználását, és nem is jelenik meg benne semmilyen felirat.
Aki viszont a gép által írt szöveget változtatás nélkül, sajátjaként adja tovább – weboldalra, dolgozatba, ajánlatba –, annak érdemes tudnia, hogy a szöveg eredete idővel kimutathatóvá válhat. Weboldalak esetében ez különösen érdekes kérdés, hiszen a keresők és a megrendelők is egyre jobban figyelnek arra, hogy a tartalom mögött valódi szakértelem áll-e.
A tanulság ugyanaz, mint eddig: a mesterséges intelligencia jó segéd, de a végleges szöveget érdemes saját hangon, saját tapasztalattal megírni. Ha a weboldalad szövegeihez kérnél segítséget, keress bátran.