Izpostavljeno

Preberite tudi

DomovTehnologijaUmetna inteligencaChatGPT bo v EU dobil nevidni vodni žig: OpenAI...

ChatGPT bo v EU dobil nevidni vodni žig: OpenAI želi označiti besedila umetne inteligence

OpenAI bo v prihodnjih tednih začel v besedila, ki jih v Evropski uniji ustvarjata ChatGPT in Codex, dodajati nevidni digitalni vodni žig. Uporabnik v odgovoru ne bo videl posebne oznake ali znaka, sistem pa bo v izbiro besed vgradil statistični vzorec, ki ga bo mogoče zaznati s posebnim detektorjem. Sprememba prihaja zaradi novih zahtev evropskega Akta o umetni inteligenci, ki od ponudnikov generativne AI zahteva strojno prepoznavno označevanje umetno ustvarjene vsebine.

Poudarki:

  • ChatGPT in Codex bosta v EU v primerna besedila postopoma začela dodajati nevidni vodni žig textGrain.
  • Oznaka ni skrit znak ali metapodatek, temveč statistični vzorec v načinu, kako model izbira besede in dele besed.
  • Sistem ni nezmotljiv: že zmerno preoblikovanje besedila lahko občutno zmanjša verjetnost zaznave vodnega žiga.

Vodni žig bo del samega besedila

OpenAI svojo tehnologijo imenuje textGrain. Deluje precej drugače od klasičnega vodnega žiga na fotografiji ali metapodatkov, ki jih lahko najdemo v digitalni datoteki.

Jezikovni model pri ustvarjanju stavka ves čas izbira med več možnimi naslednjimi besedami oziroma tokeni. textGrain pri teh izbirah zelo rahlo prilagodi verjetnosti, tako da skozi daljše besedilo nastane statistični vzorec. Za bralca je rezultat videti popolnoma običajno, namenski detektor pa lahko poskuša ugotoviti, ali vzorec ustreza OpenAI-jevemu vodnemu žigu.

Pomembno je, da sistem ne dodaja nevidnih znakov, dodatnih presledkov ali posebnih ločil. Če besedilo kopirate iz ChatGPT v WordPress, Word ali elektronsko pošto, se vanj ne prilepijo skrivni znaki. Signal je vgrajen neposredno v statistično strukturo izbire besed.

Zakaj sprememba za zdaj velja predvsem za Evropsko unijo?

Glavni razlog je evropski AI Act.

Člen 50 evropskega Akta o umetni inteligenci od ponudnikov določenih generativnih sistemov zahteva, da so njihove umetno ustvarjene ali spremenjene vsebine označene v strojno berljivi obliki. Evropska pravila glede transparentnosti so se začela uporabljati 2. avgusta 2026, njihov namen pa je olajšati prepoznavanje AI vsebin, zlasti v okolju, kjer postajajo ponarejene fotografije, videoposnetki in besedila vedno težje prepoznavni.

OpenAI zato uvaja regionalni pristop. Vodni žig bo v prihodnjih tednih postopoma vključen v primerna besedila uporabnikov ChatGPT in Codexa v EU na vseh naročniških paketih, medtem ko za preostali svet za zdaj ne bo privzeto vključen.

Za uporabnike API-ja je ureditev nekoliko drugačna. Organizacije po svetu lahko že zdaj označevanje textGrain prostovoljno vključijo za podprte modele, privzeto pa ostaja izključeno.

Ali bo mogoče takoj ugotoviti, da je članek napisal ChatGPT?

Ne nujno – in prav tukaj postane tehnologija zanimiva.

OpenAI poudarja, da vodni žig ni dokaz avtorstva. Če detektor zazna signal, to pomeni predvsem, da je določeno besedilo verjetno ustvaril ali obdelal OpenAI-jev sistem. Ne pove pa, kdo je ChatGPT uporabljal, kakšno navodilo mu je dal ali koliko besedila je pozneje spremenil človek.


Prav tako vodni žig ne dokazuje, da je vsebina pravilna, zakonita ali v celoti ustvarjena z umetno inteligenco. Model je lahko na primer zgolj uredil človekovo besedilo, pri čemer se lahko signal vseeno pojavi.

Tudi obratno ne velja: če detektor oznake ne najde, to še ne pomeni, da je besedilo napisal človek. Besedilo je lahko prekratko, močno predelano, prevedeno ali ustvarjeno z drugim modelom.

Nekaj preprostega urejanja lahko oznako precej oslabi

To je trenutno največja omejitev sistema.


Pri OpenAI-jevih testih je detektor ob ciljni enoodstotni stopnji lažno pozitivnih rezultatov pri približno 200 tokenih določenih vrst besedil zaznal okoli 80 odstotkov vodnih žigov, pri 400 tokenih pa približno 95 odstotkov. Pri bolj omejenih vsebinah, kot je matematika, je bila učinkovitost nižja.

Še bolj zanimiv je vpliv naknadnega urejanja. Pri testu 400-tokenov dolgih besedil je zamenjava približno 10 odstotkov besed s sopomenkami zmanjšala zaznavnost z okoli 92 na 66 odstotkov. Če so spremenili četrtino besed, je zaznavnost padla na samo 17 odstotkov.

Zato textGrain za zdaj ni čarobno orodje, s katerim bi bilo mogoče zanesljivo preveriti vsak seminarski članek, novinarsko besedilo ali objavo na družbenem omrežju.

Kratka besedila in programska koda imajo posebno obravnavo

Evropska pravila in spremljajoči kodeks ravnanja upoštevajo tudi praktične omejitve tehnologije.


OpenAI pojasnjuje, da vodni žig ni predviden za določene zelo kratke odgovore in fragmente programske kode. Pri besedilih pod približno 200 tokenov oziroma približno 150 angleških besed je statističnega materiala preprosto premalo za dovolj zanesljivo zaznavanje.

Podobna težava nastane pri kodi, matematičnih formulah in drugih vsebinah, kjer model nima veliko svobode pri izbiri besed. Če obstaja le nekaj pravilnih načinov za zapis rezultata, je veliko težje ustvariti statistični vzorec, ne da bi pri tem poslabšali kakovost odgovora.

Ali bo ChatGPT zaradi tega pisal drugače?

OpenAI trdi, da v dosedanjih testih ni zaznal pomembnega poslabšanja kakovosti odgovorov.

Podjetje je primerjalo rezultate svojih modelov z vključenim in izključenim textGrainom na več testih programiranja, znanja, znanosti in uporabe orodij. Razlike so bile po njihovih navedbah znotraj običajnega statističnega nihanja. Tudi vpliv na hitrost ustvarjanja besedila naj bi bil zanemarljiv.


Za uporabnika naj bi bila sprememba zato praktično neopazna. Odgovori ne bodo dobili posebne ikone, drugačne pisave ali vidnega opozorila samo zato, ker vsebujejo textGrain.

Detektor za zdaj ne bo na voljo vsem

Tu je še ena pomembna omejitev.

OpenAI svojega detektorja vodnih žigov ob začetku ne bo odprl širši javnosti. Dostop bodo najprej lahko dobili odobreni raziskovalci in strokovne organizacije, ki bodo pomagali ocenjevati zanesljivost sistema in tveganje napačnih interpretacij rezultatov.

To pomeni, da učitelj, urednik ali običajni uporabnik ob uvedbi ne bo mogel preprosto prilepiti besedila na OpenAI-jevo stran in dobiti odgovora, ali ga je ustvaril ChatGPT.


Razlog so predvsem lažno pozitivni in lažno negativni rezultati. Če bi takšno orodje uporabljali kot dokončen dokaz pri ocenjevanju šolskih nalog, zaposlovanju ali ugotavljanju plagiatorstva, bi lahko napačen rezultat imel resne posledice.

Besedila postajajo naslednji veliki izziv za dokazovanje izvora

Pri slikah in zvoku je razvoj označevanja AI vsebin že precej napredoval. OpenAI pri podprtih slikah uporablja standard C2PA Content Credentials in nevidne vodne žige SynthID, podobno tehnologijo pa uporablja tudi pri zvoku.

Besedilo je precej težji problem, ker ga je mogoče v nekaj sekundah prekopirati, skrajšati, prevesti ali prepisati z drugim modelom. Že manjši posegi lahko statistični vzorec občutno oslabijo.


textGrain zato verjetno ne bo dokončna rešitev vprašanja, kako ločiti človeško in AI pisanje. Je pa pomemben prvi korak k svetu, kjer bo digitalna vsebina vse pogosteje nosila nevidne podatke oziroma signale o svojem izvoru.

Za milijone evropskih uporabnikov bo sprememba potekala povsem v ozadju. ChatGPT bo na zaslonu videti enako kot danes – le njegove besede bodo lahko v prihodnje nosile neviden podpis.

Se vam zdijo naši članki zanimivi in koristni? Dodajte Planet24.si kot svoj priljubljen vir novic na Googlu.
Google
Nastavi ›
.

Sorodne vsebine