Hogyan alakítja át a média világát az AI-szövegek vízjelezése?
Az Európai Unió mesterséges intelligenciáról szóló jogszabálya (AI Act) alapjaiban változtatja meg a digitális tartalomgyártást. A technológiai óriások, élükön az OpenAI-jal, olyan láthatatlan statisztikai vízjel-rendszert vezettek be, amely szinte észrevehetetlenül, mégis kitörölhetetlenül megbélyegzi a gépek által generált szövegeket. De hogyan képes egy algoritmus kódolt szóválasztásokkal „lebuktatni” önmagát, és mit jelent ez a technológiai fegyverkezési verseny a szerkesztőségek, a fake news elleni harc és a hagyományos újságírás számára?
Nyomok a szövegben
A minap rövid levél érkezett a szerkesztőségbe, ahol dolgozom. Egy magát tanárnak mondó ismeretlen küldött cikket, kérve, hogy közöljük, ha lehet. Átfutottam és sugárzott belőle az gépi-jelleg. Az AI nyilvánosan elérhető szöveggeneráló programjaival előállított cikkek jól fölismerhető, egyedi stílusjegyekkel rendelkeznek, éppen olyanokkal, amelyek az érkezett írást is jellemezték. A szöveg tartalma ugyancsak azt a meglehetősen hamis AI-optimizmust tükrözte, amely távol áll a valóságos tapasztalatoktól. Mindezt meg is írtam a szerzőnek, pontosabban nem a szerzőnek, hanem levélírónak, azzal, hogy saját gondolatait, tapasztalatait szívesen fogadjuk. Egyelőre nem jelentkezett…
Persze nem mindig olyan egyszerű kiszúrni a szöveggeneráló programok jelenlétét. Vannak olyan programok, amelyek felismerhetetlenül eredeti módon írnak. Nos, hogy ezek is felismerhetőek legyenek, az OpenAI bevezetett egy láthatatlan vízjel-rendszert. A kezdeményezést elsősorban az Európai Unió mesterséges intelligenciáról szóló jogszabályának (AI Act) való megfelelés motiválta. Az Unió ugyanis immár szigorúan előírja a fejlesztőknek, hogy egyértelműen és azonosítható módon jelöljék meg a mesterséges intelligencia által létrehozott tartalmakat. Valószínűleg vannak más okok is a háttérben. Leginkább nyilván a modellek önfertőzésének megelőzése. Hiszen, ha a jövőbeli AI-modelleket olyan internetes tartalmak mentén tanítják, amelyeket már eleve mesterséges intelligencia generált, a modellek minősége gyorsan leromolhat. A vízjel segít a fejlesztőknek kiszűrni a szintetikus tartalmakat a tanítóadatok közül. A Open AI további érveket is felsorol. Üzleti szempontból fontos lehet az akadémiai és szakmai tisztesség védelme. A jelölés (és a hozzá tartozó detektáló eszköz) lehetővé teszi az oktatási intézmények és a munkáltatók számára annak kiszűrését, ha valaki saját szellemi termékeként próbál meg eladni egy ChatGPT vagy Codex által írt szöveget, illetve programkódot. És végül persze azt is érdemes megemlíteni, hogy a láthatatlan statisztikai mintázat segít ellenőrizni a szövegek eredetét, így megnehezíti, hogy az AI-t tömeges álhírgyártásra, politikai manipulációra vagy csalásokra használják fel.
Piros szavak, zöld szavak
Bizonyára sokan vannak, akik azonnal értik, mit is jelent a „láthatatlan vízjel-rendszer”, amiről az Open AI beszél, ám a többség valószínűleg tanácstalanul vakarja a fejét. Pedig a dolog egyszerű, ámde ötletes – hogy Jack Sparrow kapitányt idézzem…
A jelölés nem valami látható pecsétet vagy szöveges címkét jelent, hanem egy statisztikai mintázatot (kódolt szóválasztásokat), amelyet a nyelvi modell generálás közben észrevétlenül beépít a mondatokba. Az emberi szem nem látja, az olvasó nem érzékeli, de egy speciális detektáló szoftverrel egyértelműen kimutatható.
A „kódolt szóválasztás” (melyet gyakran statisztikai vízjelnekneveznek) olyan matematikai eljárás, ahol az AI-modell a szövegírás közben bizonyos szavakat vagy szótagokat enyhén előnyben részesít a szinonimáikhoz képest egy titkos kulcs alapján. A szöveg tökéletesen természetes és nyelvtanilag helyes marad, a háttérben viszont egy matematikai trükk fut. Amikor ugyanis egy AI modell leír egy mondatot, minden egyes szónál kiszámítja, hogy melyek volnának a logikailag és nyelvtanilag leginkább odaillő következő szavak, és ezekhez egy-egy valószínűségi pontszámot rendel. A rendszer egy titkos kulcs és az előzőleg leírt szavak alapján a lehetséges következő szavakat két csoportra osztja. A zöld listára kerülnek azok a szavak, amelyek használatát a vízjelrendszer enyhén támogatni fogja, a piros listára pedig azok a kifejezések, amelyek bár szintén odaillenének a mondatba, a rendszer mégsem preferálja azokat. Ha például az AI azt a mondatot írja, hogy „A feladatot gyorsan el kell végezni”, a „gyorsan” szó helyett választhatná azt is, hogy „hamar”, „sürgősen” vagy „haladéktalanul”. Az emberi szerző kívülről nézve véletlenszerűen választ a szinonimák közül (Miközben persze neki magának jó oka lehet arra, hogy miért éppen azt a szót tartja oda illőnek.) Ha viszont az OpenAI rendszere generálja a szöveget, akkor, a titkos kulcs kódolása miatt matematikailag nagyobb eséllyel fog a „zöld listás” szinonimákhoz nyúlni.
Az olvasó számára ez a mintázat teljesen láthatatlan, mivel a mondatok értelmesek maradnak, semmi furcsaságot nem hordoznak. Amikor azonban egy ellenőrző szoftver (amely ismeri a titkos kulcsot) megvizsgálja a szöveget, megszámolja, hogy a szavak milyen arányban származnak a zöld listáról. Ha egy hosszabb szövegben (jellemzően 200 token vagy annál több felett) a zöld listás szavak jelenléte statisztikailag kirívóan magas – messze meghaladja a természetes emberi nyelvhasználat során elvárható véletlenszerű arányt –, a program szinte 100%-os biztonsággal meg tudja állapítani, hogy a szöveget mesterséges intelligencia generálta.
Ügyes! Nem?
Na, azért tegyük hozzá, egy rutinos tollforgató lazán ki tudja játszani a rendszert. Ha a felhasználó alaposan átfogalmazza a szöveget, szinonimákra cseréli a szavak egy részét, vagy lefordítja egy másik nyelvre, a kódolt szóválasztási mintázat (és ezzel a vízjel) jelentősen legyengül vagy teljesen eltűnik.
Prémium lapok: „100% emberi munka”
Mindazonáltal leszögezhetjük, hogy az írott média, az újságírás, tartalomgyártás, könyvkiadás mérföldkőhöz érkezett azzal, hogy az OpenAI textGrain technológiája, valamint az Anthropic és a Google hasonló rendszerei az EU AI Act szabályozása miatt bevezették az láthatatlan szöveges vízjeleket.
Talán legfontosabb az, hogy a főszerkesztők és a kiadók kezébe végre olyan eszközök kerülnek, amelyekkel ellenőrizhetik a külsős szerzők, újságírók munkáit. Olyan kezdeményezések, mint a Press Gazette által indított Made by Humans nevű ellenőrző platform, közvetlenül a nagy AI-gyártók kulcsait használva képesek kiszűrni, ha egy cikket teljes egészében a ChatGPT írt. Ez segít fenntartani a médiumok hitelességét és az egyes orgánumok értékét.
A keresőmotorok (elsősorban a Google) a jövőben a vízjel-detektáló algoritmusok segítségével sokkal hatékonyabban tudják majd háttrébb sorolni a tömegesen gyártott, hozzáadott érték nélküli AI-cikkeket. A kattintásvadász, robotok által írt oldalak visszaesésére lehet számítani, ami hosszú távon a minőségi újságírásnak kedvez.
Persze ettől még virágozhat a gépi tartalomgyártás, csak hasonlóan ahhoz, ahogy a bioélelmiszereknél vagy a kézműves termékeknél léteznek minőségi pecsétek, az írott médiában is felértékelődik a „100% emberi munka” védjegye. Azok a lapok, amelyek garantálni tudják (és a vízjel-detektorokkal bizonyítani is képesek), hogy cikkeik mentesek a generatív mintázatoktól, magasabb előfizetési díjat vagy prémium hirdetési árakat kérhetnek a piacon.
Ne hallgassuk el azonban azt sem, hogy a vízjelrendszer elgondolkodtató szakmai vitát váltott ki. A vízjel ugyanis csak azt mutatja meg, hogy az AI részt vett a szövegalkotásban, azt viszont nem, hogy milyen mértékben. Ha például egy újságíró saját maga kutatja fel a sztorit, de a nyelvi modellel javíttatja ki a helyesírást, vagy vele íratja át a címeit, a szövegben megjelenhet a vízjel. Tulajdonképpen kevés igazságtartalommal.
A médiának tehát rövidesen ki kell alakítania az AI-asszisztált munka pontos etikai határait. Ami nem is lesz olyan egyszerű. Mivel a vízjel lényegében egy statisztikai szóválasztási mintázat, a rutinos tartalomgyártók gyorsan megtalálják majd a kiskapukat. Ha a generált nyers szöveget egy másik (nem vízjelezett) átíró szoftverrel lefordíttatják, vagy manuálisan átfogalmazzák, a vízjel eltűnik. Ez azt jelenti, hogy a hanyag, de technológiailag képzettebb „tartalomgyárak” továbbra is eláraszthatják a webet AI-szövegekkel.
Mindent összevetve a vízjel növeli a transzparenciát az olvasók és a kiadók felé, de nem oldja meg varázsütésre a dezinformáció, a plagizálás és főleg nem az újságírói lustaság (vagy túlterheltség) problémáját. Inkább egyfajta digitális eredetiségi tanúsítványként fog működni az írott kultúrában.