Anthropic objasnio kako radi vodeni žig u Claudeovom tekstu
Zvanično objašnjenje mehanizma kojim se u tekst koji Claude generiše upisuje vodeni žig. Uz nova evropska pravila o označavanju, tema prestaje da bude tehnička zanimljivost i ulazi u područje usklađenosti s propisima, jer nudi način da se porijeklo sadržaja utvrdi i onda kada se onaj ko ga objavljuje na to ne pozove.
Anthropic je 14. avgusta objavio odgovore na pitanja o tome kako radi vodeni žig u tekstu koji Claude generiše. Mehanizam je izveden iz postupka SynthID-Text koji dolazi iz Google DeepMinda. Tempo nije slučajan, jer evropski propis traži transparentnost od 2. avgusta.
Kako radi
U tekst se ne ubacuju skriveni znakovi niti se odgovor naknadno mijenja. Umjesto toga mijenja se izvor slučajnosti koji model koristi za jedan dio izbora riječi.
Ti su izbori pojedinačno beznačajni, ali ih u dužem tekstu ima mnogo, pa zajedno ostavljaju obrazac. Čitalac ga ne primjećuje, a prepoznaje ga svako ko ima ključ kojim je taj obrazac zapisan.
Zašto baš sada
Označavanje koje zavisi samo od dobre volje onoga ko objavljuje otpada čim neko prenese tekst u drugi sistem. Žig upisan u sam tekst nastoji da porijeklo putuje zajedno sa sadržajem.
Anthropic se time pridružuje OpenAI-ju i Googleu u objašnjavanju kako namjerava da ispuni zahtjeve evropskog propisa. Prema stranici podrške, novi Claude modeli objavljeni u Uniji od 2. avgusta podržavaju označavanje od samog početka.
Šta ovo ne rješava
Žig preživljava kopiranje teksta, ali ne i prepisivanje. Ako čovjek ili drugi model temeljno preoblikuje sadržaj, obrazac se gubi. Riječ je, dakle, o sredstvu za utvrđivanje porijekla, a ne o dokazu da nešto nije nastalo uz pomoć AI.
Izvori
Povezano
Kako označiti AI sadržaj po članu 50, i koji dio toga nije tvoj posao
Član 50 Akta Evropske unije o vještačkoj inteligenciji primjenjuje se od 2. avgusta 2026. i obavezuje svakoga ko opslužuje ljude u Uniji, bez obzira na to gdje mu stoji server. Najviše zabune pravi obaveza mašinski čitljivog označavanja, koja je za vlasnika sajta što poziva tuđi API zapravo obaveza njegovog dobavljača. Evo šta jeste tvoje: asistent koji kaže šta je, objavljen tekst koji nosi ili potpis ili oznaku, i lažni snimak koji to priznaje.
Evropska komisijaprovjereno
Pew izmjerio: 35 odsto stranica nastalih poslije ChatGPT-a nosi trag mašinskog pisanja
Pew Research je kroz detektor propustio blizu pola miliona stranica iz arhive Common Crawl. Među onima objavljenim poslije novembra 2022. više od trećine je vratilo jasan trag mašinskog pisanja, a domeni .com pokazuju ga desetostruko češće nego .edu i .gov.
TechCrunchprovjereno

Gemma prešla milijardu preuzimanja i 100.000 izvedenih modela
Google je 20. avgusta saopštio da je porodica otvorenih modela Gemma prešla milijardu preuzimanja. Za dvije godine postojanja zajednica je objavila više od 100.000 izvedenih modela, a na posljednjem takmičenju na Kaggleu prijavljeno je više od 1.600 projekata. Uz objavu je pokrenuto spremište Awesome Gemma na GitHubu, zamišljeno kao popis provjerenih projekata, dorađenih modela, uputstava i alata. Brojka je zanimljiva i nekome ko pravi sajtove, jer model koji se pokreće na sopstvenom serveru prestaje da bude rijetkost, pa obrada teksta bez slanja podataka trećoj strani postaje izvodljiva.
Googleprovjereno
