Google je predstavio Gemini 4 Argon, ali ga zasad dobijaju samo timovi za sajber bezbjednost
Google je 30. septembra 2026. predstavio model Gemini 4 Argon. Model se postepeno uvodi kod izabranih timova za sajber bezbjednost kroz program Fairwind, a za programere, preduzeća i ostale korisnike datum nije naveden. Uvodna cijena je 2 dolara po milionu ulaznih i 10 dolara po milionu izlaznih tokena, a poslije uvodnog perioda iznosi 4 dolara i 20 dolara. Ograničenje izlaza povećano je sa 64 hiljade na 1 milion tokena. Rezultate mjerenja objavio je sam Google i zasad ih niko izvan programa ne može provjeriti.
Izvor
Gemini 4 Argon: our next era of frontier intelligenceGoogle DeepMind Blog · Original objavljen 30. septembra 2026.
Gemini 4 Argon je novi vodeći model kompanije Google, ali ga većina korisnika još ne može pozvati. Google navodi da pristup prvo dobijaju provjereni timovi za sajber bezbjednost u programu Fairwind. Šira dostupnost počeće od korisnika plaćenog API-ja i pretplatnika plana Google AI Ultra. Cijena i novo ograničenje izlaza su objavljeni, pa se troškovi mogu planirati unaprijed.
Ko dobija pristup i kada
Google izdanje opisuje kao postepeno. Prvu grupu čine provjereni timovi za sajber bezbjednost primljeni kroz Fairwind, program ograničenog pristupa za vlade i partnere od povjerenja, koji je Google pokrenuo početkom septembra. Kompanija navodi da učestvuje u dobrovoljnom postupku američke vlade za pristup modelima prije objavljivanja, dok postepeno širi dostupnost.
Za ostale korisnike objava ne navodi datum. Google kaže da će Argon programerima, preduzećima i potrošačima učiniti dostupnim što prije, i to prvo korisnicima plaćenog API-ja i pretplatnicima plana Google AI Ultra. Provjereni timovi za odbranu i Googleovi interni timovi dobiće, prema objavi, model bez zaštitnih ograničenja za sajber bezbjednost.
Koliko košta
Uvodna cijena modela je 2 dolara po milionu ulaznih tokena i 10 dolara po milionu izlaznih tokena. Keširani ulazni tokeni naplaćuju se 95 odsto jeftinije od ulaznih, što po uvodnoj cijeni iznosi 0,10 dolara po milionu. U fusnoti objave piše da će poslije uvodnog perioda cijena biti 4 dolara po milionu ulaznih i 20 dolara po milionu izlaznih tokena. Google ne navodi koliko uvodni period traje.
Uvodni iznosi poklapaju se s cjenovnikom konkurenta. OpenAI-jev cjenovnik API-ja za GPT-6.1 Sol navodi 2 dolara po milionu ulaznih, 0,10 dolara po milionu keširanih ulaznih i 10 dolara po milionu izlaznih tokena. Iz toga se može zaključiti da je Google uvodnu cijenu izjednačio sa Solom, a višu ostavio za kasnije. Za dugoročni budžet zato su mjerodavni iznosi od 4 dolara i 20 dolara.
Ograničenje izlaza raste na 1 milion tokena
Ograničenje izlaza povećano je na 1 milion tokena, a ranije je iznosilo 64 hiljade. Google to obrazlaže time da model koji u jednom prolazu može da proizvede stotine hiljada tokena složen problem rješava iz jednog pokušaja. Praktična posljedica je trošak: odgovor koji popuni cijelo ograničenje košta 10 dolara po uvodnoj cijeni izlaza, a 20 dolara poslije uvodnog perioda.
Šta Google navodi o mjerenjima
Sve brojke u nastavku potiču iz Googleove objave, a model nije dostupan za nezavisno testiranje.
- Na testu DeepSWE v1.1, koji mjeri dugotrajne zadatke softverskog inženjerstva, Google navodi rezultat od 77,9 odsto i naziva ga najboljim dosad.
- Na Zapierovom testu AutomationBench, koji mjeri izvršavanje poslovnih zadataka od početka do kraja, Google navodi 51,3 odsto i prvo mjesto.
- Na testu LVBench, koji mjeri razumijevanje dugih video-zapisa, Google navodi 91,7 odsto.
- Na testu CWE-bench v1, koji mjeri otklanjanje bezbjednosnih ranjivosti, Google navodi 68 odsto i podijeljeno prvo mjesto.
- Za Vals Index, koji finansije, programiranje, pravo i poreze vrednuje prema udjelu u američkom BDP-u, Google tvrdi da ga Argon predvodi, ali rezultat ne navodi.
Sajber odbrana i interna upotreba
Google navodi da je Argon obučen da samostalno pronalazi, potvrđuje i otklanja kritične ranjivosti u softveru. Prema objavi, kompanija Wiz koristila je model u inicijativi Scan for Good i pronašla kritičnu ranjivost koja je izlagala osjetljive lične podatke u zdravstvenom softveru koji koriste bolnice. Google ne navodi ni naziv softvera ni proizvođača.
Kompanija opisuje i interne rezultate. Tim Argonovih agenata je, prema objavi, primijenio optimizacije memorije u Googleovim podatkovnim centrima, koje poslije uvođenja oslobađaju više od 300 TiB memorije. Za libgav1, Googleov softver otvorenog koda za dekodiranje videa, objava navodi da su agenti u postojećoj verziji na jeziku Rust zamijenili 32 hiljade linija SIMD koda. Dobijeni dekoder je, prema Googleu, 2,7 puta brži od te verzije, uz istovjetan video na izlazu.
Zaštite prije šire dostupnosti
Google navodi četiri oblasti u kojima još jača zaštitu: zloupotrebu, zlonamjerno ubacivanje uputstava (prompt injection), neusklađeno ponašanje modela i bezbjednost sopstvenih okruženja za testiranje. Kompanija navodi da nadzire Argonov tok rezonovanja i njegove radnje i da po potrebi prekida izvršavanje, kao i da prati unutrašnje aktivacije modela radi otkrivanja zloupotrebe. Google tvrdi i da Argon predvodi test indirektnog ubacivanja uputstava kompanije Gray Swan, takođe bez objavljenog rezultata.
„Bezbjedno objavljivanje sposobnosti ovog nivoa zahtijeva postepen pristup.“
Izvori
Povezano

OpenAI uvodi vodeni žig u tekst ChatGPT-a i Codexa u EU, a u API-ju se uključuje po izboru
OpenAI je 5. oktobra 2026. objavio kako će tekst koji generišu njegovi modeli označavati vodenim žigom, radi usklađivanja s Aktom Evropske unije o vještačkoj inteligenciji (EU AI Act). Tekst iz ChatGPT-a i Codexa u Evropskoj uniji dobiće u narednim sedmicama nevidljiv vodeni žig pod nazivom textGrain. Korisnici API-ja u cijelom svijetu mogu od istog dana da ga uključe za odabrane modele, a podrazumijevano je isključen. Detektor nije javan: pristup dobijaju samo odobreni istraživači i stručne organizacije.
OpenAIprovjereno
Šest komercijalnih rutera modela u novom radu nije nadmašilo nasumičan izbor između dva modela
Rad predat na arXiv 2. oktobra 2026. ispitao je šest komercijalnih rutera velikih jezičkih modela u 14 podešavanja. Autori navode da nijedno podešavanje nije nadmašilo ruter koji uz isti trošak nasumično bira između modela Gemini 3.7 Flash i Opus 5, a jedno je zaostalo 10,5 procentnih poena. Autori, zaposleni u kompaniji Fastino Labs, razliku objašnjavaju načinom na koji se ruteri ocjenjuju i prevelikim skupovima modela. Rad nije prošao recenziju.
arXiv, Fastino Labsprovjereno

Microsoftov ThinkingBox pokazuje da nijedan model ne rješava pola zadataka 20 puta zaredom
Microsoftov tim Copilot Studio objavio je 3. oktobra 2026. na blogu platforme Hugging Face rezultate testa performansi ThinkingBox. Test svaki od 507 poslovnih tokova rada pokreće 20 puta po modelu i ocjenjuje stanje baze podataka koje agent ostavi, a ne njegovu završnu poruku. Microsoft navodi da Claude Opus 5.5 ima najbolji rezultat u pojedinačnom pokušaju, 67,16 odsto, ali da u svih 20 pokušaja rješava samo 241 zadatak. Prema autorima, približno četiri od pet neuspjeha potiču od rukovanja alatima, a ne od rezonovanja.
Microsoft, Hugging Faceprovjereno
