Nevidljivi vodeni žigovi u Claude AI: Nova era transparentnosti i borba protiv dezinformacija

U svijetu u kojem generativna umjetna inteligencija (AI) postaje svakodnevni alat za pisanje, programiranje i stvaranje vizualnog sadržaja, granica između ljudskog i strojnog rada postaje sve nevidljivija. Kako bi odgovorili na ovaj izazov i ispunili stroge zakonske zahtjeve, tvrtka Anthropic najavila je uvođenje nevidljivih vodenih žigova u tekstove koje generira njihov model, Claude. Ova tehnologija omogućuje identifikaciju sadržaja stvorenog pomoću AI-ja, ali na način koji je potpuno neprimjetan običnom čitatelju.

Uvođenje ovakvih mehanizama nije samo tehnološka inovacija, već strateški odgovor na potrebu za većom transparentnošću u digitalnom prostoru. Svrha je omogućiti ovlaštenim stranama da prepoznaju podrijetlo teksta, čime se smanjuje rizik od širenja dezinformacija i manipulacije javnošću putem sofisticiranih “deepfake” tekstova.

Kako zapravo funkcionira nevidljivo označavanje teksta?

Za razliku od klasičnih vodenih žigova koji se vide kao polutransparentni logotipi na slikama ili PDF-ovima, vodeni žig u Claude AI-ju ne koristi vizualne oznake niti skrivene znakove u kodu teksta. Umjesto toga, metoda se temelji na samom procesu generiranja riječi, odnosno na statističkom odabiru tokena.

Veliki jezični modeli (LLM) rade tako što predviđaju sljedeću riječ u rečenici iz popisa potencijalno odgovarajućih opcija. U normalnim okolnostima, AI koristi generator slučajnih brojeva kako bi odabrao jednu od tih riječi, što rezultira prirodnim i varijabilnim stilom pisanja. Međutim, kada je aktiviran vodeni žig, Claude više ne bira riječi nasumično, već koristi specifičan matematički ključ.

Kao primjer, Anthropic navodi korištenje znamenki broja pi (π) kao ključa. Ako ključ u određenom trenutku nalaže znamenku “2”, sustav će odabrati riječ koja se nalazi na specifičnoj poziciji u popisu mogućnosti. Taj suptilni uzorak, koji je ljudskom oku potpuno neprimjetan, stvara digitalni otisak koji može dekodirati samo osoba ili sustav koji posjeduje odgovarajući ključ. Ova metoda je inspirirana pristupom SynthID-Text koji je razvio Google DeepMind, čime se potvrđuje trend standardizacije u industriji AI alata.

Usklađivanje s EU Aktom o umjetnoj inteligenciji

Glavni pokretač ove promjene je zakonodavstvo Europske unije, konkretno Akt o umjetnoj inteligenciji (EU AI Act). Članak 50. ovog akta izričito zahtijeva transparentnost za sadržaj generiran umjetnom inteligencijom. EU želi osigurati da korisnici interneta znaju kada komuniciraju s botom ili čitaju tekst koji nije napisao čovjek, kako bi se spriječilo masovno širenje lažnih vijesti.

Nepoštivanje ovih pravila može dovesti do ogromnih novčanih kazni za tehnološke kompanije, što je razlog zašto ne samo Anthropic, već i giganti poput Googlea, Mete, Microsofta i OpenAI-ja implementiraju slične sustave. Svi oni potpisali su Kodeks prakse EU-a o transparentnosti, čime se signalizira kraj ere “anonimnog” AI sadržaja.

Ograničenja tehnologije i potencijalni problemi

Iako je tehnologija impresivna, ona nije nepogrešiva. Anthropic otvoreno priznaje određena ograničenja koja korisnici trebaju imati na umu:

  • Vjerojatnost, a ne dokaz: Vodeni žig može ukazati na veliku vjerojatnost da je Claude sudjelovao u stvaranju teksta, ali to nije apsolutni dokaz.
  • Uređivanje i prevođenje: Ako korisnik koristi Claudea samo za ispravak gramatike ili prijevod vlastitog teksta, taj će tekst također biti označen, što može stvoriti problem ljudskim autorima čiji bi rad mogao biti pogrešno klasificiran kao AI-generiran.
  • Kratki sadržaji: U vrlo kratkim rečenicama ili tekstovima koji su nakon generiranja drastično prepisani ljudskom rukom, vodeni žig može postati nedetektibilan.
  • Potpuno prepisivanje: Jedini siguran način za uklanjanje oznake je potpuno ručno ponovno pisanje teksta.

Ova ograničenja izazvala su mješovite reakcije. Dok neki vide u ovome nužan korak za sigurnost, drugi strahuju od “lažno pozitivnih” rezultata gdje bi legitimni ljudski rad bio označen kao umjetni zbog minimalne upotrebe AI alata za poliranje teksta.

Utjecaj na programski kod i vizualni sadržaj

Jedno od najzanimljivijih pitanja odnosi se na programski kod. Budući da kod zahtijeva preciznost i često postoji samo jedan ispravan način za napisati određenu funkciju, prostor za “nasumični odabir” riječi je puno manji. Zbog toga programski kod ima znatno manje vodenih žigova nego običan tekst. Ako AI nema izbora koju riječ koristiti kako bi kod radio, on ne može primijeniti ključ za označavanje.

Što se tiče slika, pristup je drugačiji. Claude će slike označavati putem kriptografski potpisanih metapodataka. Za to se koristi otvoreni standard C2PA (Coalition for Content Provenance and Authenticity), koji je već usvojen od strane Adobea i Googlea. To znači da će u samim podacima datoteke biti zapisano da je slika generirana umjetnom inteligencijom.

Zaključak

Uvođenje nevidljivih vodenih žigova u Claude AI predstavlja značajan pomak prema odgovornijem razvoju umjetne inteligencije. Iako tehnologija nosi određene rizike, poput potencijalne pogrešne klasifikacije ljudskog rada, prednosti u borbi protiv dezinformacija su daleko veće. Ovim potezom Anthropic ne samo da se prilagođava zakonima Europske unije, već pomaže u sprječavanju “kolapsa modela” – fenomena u kojem AI modeli počnu učiti iz vlastitih, označenih rezultata, što bi dugoročno moglo degradirati kvalitetu umjetne inteligencije.

Česta pitanja (FAQ)

1. Hoće li vodeni žig usporiti rad Claudea ili povećati troškove?
Ne. Prema izjavama Anthropica, proces označavanja ne utječe na brzinu generiranja, ne zahtijeva dodatne tokene niti povećava cijenu usluge za korisnike.

2. Mogu li ja kao korisnik vidjeti vodeni žig u tekstu?
Ne možete. Žig je nevidljiv i ne sadrži nikakve posebne znakove ili vizualne elemente. Može ga detektirati samo onaj tko posjeduje dekodirajući ključ.

3. Što se događa ako samo malo izmijenim tekst koji je napisao AI?
Lagano uređivanje teksta vjerojatno neće ukloniti vodeni žig. Da bi se oznaka potpuno uklonila, tekst bi morao biti značajno preoblikovan ili potpuno napisan iznova.

If you like this post you might also like these

More Reading

Post navigation

How does a hormone work… physically?

SEO Strategy for Blog Post on Hormone Biology The blog post effectively explains how hormones work by detailing their chemical mechanisms, cellular interactions, and impacts on biological processes. Key points include: 1. Hormone Function : Hormones are chemical messengers that regulate bodily...
back to top