Pew izmjerio: 35 odsto stranica nastalih poslije ChatGPT-a nosi trag mašinskog pisanja
Pew Research je kroz detektor propustio blizu pola miliona stranica iz arhive Common Crawl. Među onima objavljenim poslije novembra 2022. više od trećine je vratilo jasan trag mašinskog pisanja, a domeni .com pokazuju ga desetostruko češće nego .edu i .gov.
Izvor
How Much of the Internet Is Written With AI?Pew Research Center · Original objavljen 20. avgust 2026
Pew Research je dao brojku onome što se na webu osjeća dvije godine. Provjerom stranica iz arhive Common Crawl, istraživanje je našlo jasan trag mašinskog pisanja u 35 odsto stranica objavljenih poslije izlaska ChatGPT-a u novembru 2022. U nasumičnom uzorku od 10.000 stranica prikupljenih u julu 2026. godine, koji nužno sadrži i stranice starije od alata za pisanje, brojka je oko 10 odsto.
Kako je brojka nastala
Pew je prikupio blizu pola miliona stranica na engleskom kroz otprilike pet godina, počev od dvije godine prije ChatGPT-a, i propustio ih kroz tehnologiju za prepoznavanje firme Open Pangram. Dvije brojke odgovaraju na dva pitanja: 10 odsto je koliko nasumičan presjek weba danas izgleda mašinski napisano, a 35 odsto je koliko tako izgleda ono što je napisano poslije novembra 2022.
Podjela po domenima je ono što vrijedi zapamtiti. Stranice na .com nose trag otprilike deset puta češće nego .edu i .gov, koji su oba blizu jednog odsto. Domen .org je na 4,6 odsto. Komercijalno objavljivanje je tamo gdje je i obim, dakle tačno tamo gdje se i očekuje.
- Nasumičan uzorak, jul 2026: oko 10 odsto stranica nosi jasan trag.
- Stranice objavljene poslije novembra 2022: 35 odsto.
- Domeni .edu i .gov: oko jedan odsto svaki. Domen .org: 4,6 odsto.
- Provjereno je blizu 500.000 stranica na engleskom iz arhive Common Crawl.
Šta brojka ne može da kaže
Detektori griješe. Pangram i svaki sličan alat proglasiće neke ljudske stranice mašinskim, a greška nije ravnomjerno raspoređena: temeljno lektorisan tekst, stručno pisanje i engleski koji nije maternji klasifikatoru zvuče mašinskije. Pew to i kaže, pa je pošteno čitanje da je oblik trenda pouzdan, a pojedinačna presuda nije.
Istraživanje prati i stilske tragove koji su s godinama postali češći, među njima crtu, oksfordski zarez i sklop „nije X, nego Y“. To su podudarnosti s mašinskim nacrtom, a ne dokaz, i uzimati ih kao dokaz znači kažnjavati onoga ko tako piše oduvijek.
Zašto je ovo važno svakome ko objavljuje
Kontekst je web na kojem je Cloudflare već prijavio da je saobraćaj botova prestigao ljudski. Kad se dva nalaza slože jedan uz drugi, dobar dio weba su mašinski pisane stranice koje čitaju mašine, a ljudska publika je manji udio na oba kraja nego što sirov broj stranica sugeriše.
Za izdavača praktična posljedica nije da izbjegava alate. Posljedica je da mora umjeti da kaže šta je uradio. Stranica koja navodi kako je nastala, na čemu se zasniva i koja se ispravlja kad pogriješi preživljava filter koji stranica bez toga ne preživljava.
„Dobrim dijelom su to botovi koji čitaju stranice koje su napisali drugi botovi.“
Izvori
Povezano
Kako označiti AI sadržaj po članu 50, i koji dio toga nije tvoj posao
Član 50 Akta Evropske unije o vještačkoj inteligenciji primjenjuje se od 2. avgusta 2026. i obavezuje svakoga ko opslužuje ljude u Uniji, bez obzira na to gdje mu stoji server. Najviše zabune pravi obaveza mašinski čitljivog označavanja, koja je za vlasnika sajta što poziva tuđi API zapravo obaveza njegovog dobavljača. Evo šta jeste tvoje: asistent koji kaže šta je, objavljen tekst koji nosi ili potpis ili oznaku, i lažni snimak koji to priznaje.
Evropska komisijaprovjereno

Gemma prešla milijardu preuzimanja i 100.000 izvedenih modela
Google je 20. avgusta saopštio da je porodica otvorenih modela Gemma prešla milijardu preuzimanja. Za dvije godine postojanja zajednica je objavila više od 100.000 izvedenih modela, a na posljednjem takmičenju na Kaggleu prijavljeno je više od 1.600 projekata. Uz objavu je pokrenuto spremište Awesome Gemma na GitHubu, zamišljeno kao popis provjerenih projekata, dorađenih modela, uputstava i alata. Brojka je zanimljiva i nekome ko pravi sajtove, jer model koji se pokreće na sopstvenom serveru prestaje da bude rijetkost, pa obrada teksta bez slanja podataka trećoj strani postaje izvodljiva.
Googleprovjereno

Google daje sajtovima dugme kojim ih čitalac proglašava omiljenim izvorom
Google je 20. avgusta objavio dugme koje izdavač postavlja na sopstvenu stranicu, a čitalac jednim klikom dodaje taj sajt među svoje omiljene izvore u pretrazi. Posljedica je da se stranice tog sajta pojavljuju istaknutije u odjeljku Top Stories, u pregledima AI Overviews i u režimu AI Mode. Google navodi da su korisnici do sada odabrali više od 600.000 različitih izvora. Uz to stižu i dvije izmjene na strani čitaoca: podešavanje tema u dovodu Discover kroz meni s tri tačke i prilagodljiv zvučni pregled dana u aplikaciji Google News za Android.
Googleprovjereno