OpenAI će u tekstove koje generišu ChatGPT i Codex za korisnike u Europskoj uniji početi ugrađivati nevidljivi digitalni vodeni žig. Kompanija na ovaj način odgovara na zahtjeve Akta o umjetnoj inteligenciji EU, koji od pružalaca AI sistema traži veću transparentnost kada je riječ o sadržaju nastalom uz pomoć umjetne inteligencije.
Nova tehnologija bit će postepeno uvedena tokom narednih sedmica za korisnike ChatGPT-a i Codexa na svim paketima u Europskoj uniji. Za korisnike izvan EU ova opcija zasad neće biti standardno uključena.
Istovremeno, programeri koji koriste OpenAI API od danas mogu aktivirati ovu mogućnost za određene modele bez obzira na to gdje se nalaze, ali će ona prema zadanim postavkama biti isključena.
Vodeni žig se ne vidi, ali ostaje u tekstu
Za razliku od oznaka koje se mogu vidjeti na fotografijama ili dokumentima, OpenAI neće dodavati simbol, oznaku ili upozorenje uz generisani tekst.
Umjesto toga, sistem djeluje kroz suptilne promjene u načinu na koji AI bira riječi tokom generisanja odgovora. Tako u samom tekstu nastaje obrazac koji čitalac ne može primijetiti, ali ga odgovarajući detektor može prepoznati.
Budući da je obrazac ugrađen u izbor riječi, može ostati prisutan i nakon kopiranja i lijepljenja teksta na drugo mjesto.
OpenAI navodi da vodeni žig ne sadrži podatke koji identificiraju korisnika te da tokom testiranja nije zabilježen značajan utjecaj na kvalitet rada modela.
Kompanija je istovremeno objavila tehnički izvještaj o metodi nazvanoj textGrain, razvijenoj u saradnji s istraživačima Univerziteta Pennsylvania i Yalea.
Pojednostavljeno, tehnologija pomoću tajnog ključa utječe na odabir riječi koje model koristi prilikom stvaranja teksta. Kada se takve male promjene ponove stotinama puta, nastaje statistički obrazac na osnovu kojeg detektor može procijeniti je li sadržaj generisao OpenAI sistem.
Uređivanje teksta može otežati detekciju
Tehnologija, međutim, ima značajna ograničenja. OpenAI je tokom testiranja utvrdio da se pouzdanost detekcije smanjuje kada se AI-generisani tekst naknadno uređuje.
U jednom testu zamjena samo deset posto riječi sinonimima smanjila je stopu detekcije sa približno 92 na 66 posto.
Problematični su i veoma kratki tekstovi, matematički odgovori te prevedeni sadržaji, kod kojih je teže pouzdano utvrditi prisustvo vodenog žiga.
"Ta ograničenja doprinijela su našoj odluci da pristup detektoru u početku omogućimo samo odobrenim istraživačima i stručnim organizacijama, koji nam mogu pomoći u procjeni njegove pouzdanosti i odgovorne primjene", naveli su iz OpenAI-ja.
Upravo zbog tih ograničenja kompanija upozorava da odsustvo vodenog žiga ne predstavlja dokaz da je određeni sadržaj napisao čovjek. Tekst je mogao biti previše izmijenjen ili prekratak za pouzdanu detekciju, ali je mogao biti generisan i pomoću AI sistema neke druge kompanije.
"Vodeni žigovi mogu ukazati na to da je OpenAI sistem generisao ili obradio dio teksta, ali ne mogu pokazati u kojoj su mjeri u njegovom nastanku učestvovali ljudska procjena, uređivanje ili kreativnost", naveli su iz kompanije.
Nova pravila zbog Akta o umjetnoj inteligenciji EU
Uvođenje ove tehnologije povezano je s pravilima transparentnosti iz europskog Akta o umjetnoj inteligenciji, koja od pružalaca generativnih AI sistema zahtijevaju da sadržaj nastao uz pomoć umjetne inteligencije bude označen u formatu koji se može mašinski prepoznati.
OpenAI nije prva velika AI kompanija koja uvodi ovakav sistem. Anthropic je u augustu najavio označavanje tekstova generisanih putem Claudea, ali za razliku od OpenAI-ja, njegova odluka odnosi se na korisnike širom svijeta.
Takva odluka izazvala je i negodovanje dijela korisnika Claudea, posebno onih koji smatraju da AI koriste kao alat, dok sami daju upute, kontekst i donose ključne odluke prilikom stvaranja konačnog sadržaja.
OpenAI je tehnologiju za označavanje AI tekstova razvijao i ranije, ali je od njenog uvođenja svojevremeno odustao, između ostalog zbog bojazni da bi dio korisnika mogao prijeći na konkurentske servise koji nemaju takva ograničenja.
OpenAI, Anthropic, Google, Meta i Microsoft nalaze se među kompanijama koje su se obavezale na poštivanje europskog kodeksa prakse koji se odnosi na transparentnost sadržaja generisanog umjetnom inteligencijom.


















