TypeSafe AI otvorio je rani pristup Jevu, modelu koji vraća odluke umjesto teksta
Jev ne piše rečenice. Čita neuređen ulaz i vraća vrijednost čiji je oblik unaprijed zadat, uz ocjenu pouzdanosti za svako polje. Firma naplaćuje 0,042 dolara po milionu ulaznih tokena, izlazne tokene ne naplaćuje, a vrijeme odziva navodi između 70 i 500 milisekundi. Množioci brzine i cijene s naslovne stranice potiču iz evaluacija koje je sama firma sastavila i pokrenula.
Firma TypeSafe AI, koju je osnovao bivši istraživač kompanije OpenAI Diogo Almeida, otvorila je rani pristup modelu Jev 15. septembra 2026. Naziva ga System One modelom i opisuje kao klasu namijenjenu odlukama koje softver donosi u sebi, a ne razgovoru s čovjekom. Jev nikada ne proizvodi tekst. Vraća vrijednosti čiji su tip i opseg određeni prije poziva, i uz svaku dodaje ocjenu pouzdanosti.
Šta model zapravo vraća
Jezički model odgovara tekstom, pa program oko njega taj tekst mora da rastavi i provjeri prije nego što po njemu nešto uradi. Kod Jeva tog koraka nema. Skup mogućih odgovora i njihov oblik zadaju se u samom pozivu, model ih popunjava, a uz svaki odgovor dolazi i ocjena pouzdanosti.
Pošto je oblik određen unaprijed, model ne može da vrati polje kojeg nema ni vrijednost van zadatog skupa. Firma to predstavlja kao praktično značenje svoje tvrdnje da Jev ne može da halucinira, a tvrdnja je uža nego što izgleda: odgovor je uvijek pravilno sastavljen, što nije isto što i uvijek tačan. Uzorkovanje ide uporedo, a ne token po token, i firma upravo tu smješta svoju prednost u brzini.
Cijena i vrijeme odziva
Ulazni tokeni koštaju 0,042 dolara po milionu, što firma piše i kao 42 dolara po milijardi. Izlazni tokeni se ne naplaćuju. Za poređenje, u istoj objavi ulazna cijena današnjih jezičkih modela navedena je u rasponu od 0,20 do 10 dolara po milionu tokena, uz izlaz koji je po pravilu oko pet puta skuplji od ulaza.
Vrijeme odziva od kraja do kraja firma navodi između 70 i 500 milisekundi, mjereno na sopstvenim računarima na zapadnoj obali Sjedinjenih Država. Za iste pozive, navodi se u objavi, vodećim jezičkim modelima treba između 3 i 329 sekundi.
Odakle potiču brojke
Množioci s naslovne stranice, 193,6 puta veće ubrzanje i 444,6 puta niža cijena, izvedeni su iz četiri toka rada za evaluaciju koje je firma objavila uz njih. Svaki model dobija isti tok rada, a kao tačan odgovor uzima se prosjek onoga što vrate GPT-6 Astra i Fable 5.1.
Ograničenja firma navodi sama, što u proizvođačkoj objavi nije uobičajeno. Tokove rada za evaluaciju sastavio je njen sopstveni tim za mogućnosti modela. Prosjek odgovora dva konkurentska modela pomjera mjerilo ka ta dva modela, i to je u objavi izričito rečeno. Objavljeni množioci su, po istoj objavi, na gornjoj granici onoga što se očekuje u stvarnoj upotrebi. Udio halucinacija koji se pripisuje jezičkim modelima potiče iz saobraćaja servisa OpenRouter, dok je sopstvena nula izvedena iz garancije o obliku odgovora, a ne izmjerena.
Za šta model nije namijenjen
Jev odgovara na pitanja čiji je skup mogućih odgovora poznat prije poziva. Razvrstava, usmjerava, ocjenjuje, izdvaja podatke i grana tok programa, a broj mogućnosti u jednoj odluci ograničen je na 255. Iznad toga se poziv dijeli nadvoje: mogućnosti se prvo ocjenjuju, pa se onda bira. Sve što treba napisati, bilo odgovor, dokument ili kod, i dalje traži jezički model.
Ponuda je, dakle, zamjena za male odluke o razvrstavanju zakopane u aplikaciji, a ne za pomoćnika s kojim korisnik razgovara. Da li objavljeni množioci važe i na tuđem opterećenju, još se ne zna, jer nezavisnog mjerenja nema.
„Jev se odriče generisanja teksta, ali je optimizovan za strukturisane izlaze i ne može da halucinira.“
Izvori
Povezano

OpenAI uvodi vodeni žig u tekst ChatGPT-a i Codexa u EU, a u API-ju se uključuje po izboru
OpenAI je 5. oktobra 2026. objavio kako će tekst koji generišu njegovi modeli označavati vodenim žigom, radi usklađivanja s Aktom Evropske unije o vještačkoj inteligenciji (EU AI Act). Tekst iz ChatGPT-a i Codexa u Evropskoj uniji dobiće u narednim sedmicama nevidljiv vodeni žig pod nazivom textGrain. Korisnici API-ja u cijelom svijetu mogu od istog dana da ga uključe za odabrane modele, a podrazumijevano je isključen. Detektor nije javan: pristup dobijaju samo odobreni istraživači i stručne organizacije.
OpenAIprovjereno
Šest komercijalnih rutera modela u novom radu nije nadmašilo nasumičan izbor između dva modela
Rad predat na arXiv 2. oktobra 2026. ispitao je šest komercijalnih rutera velikih jezičkih modela u 14 podešavanja. Autori navode da nijedno podešavanje nije nadmašilo ruter koji uz isti trošak nasumično bira između modela Gemini 3.7 Flash i Opus 5, a jedno je zaostalo 10,5 procentnih poena. Autori, zaposleni u kompaniji Fastino Labs, razliku objašnjavaju načinom na koji se ruteri ocjenjuju i prevelikim skupovima modela. Rad nije prošao recenziju.
arXiv, Fastino Labsprovjereno

Microsoftov ThinkingBox pokazuje da nijedan model ne rješava pola zadataka 20 puta zaredom
Microsoftov tim Copilot Studio objavio je 3. oktobra 2026. na blogu platforme Hugging Face rezultate testa performansi ThinkingBox. Test svaki od 507 poslovnih tokova rada pokreće 20 puta po modelu i ocjenjuje stanje baze podataka koje agent ostavi, a ne njegovu završnu poruku. Microsoft navodi da Claude Opus 5.5 ima najbolji rezultat u pojedinačnom pokušaju, 67,16 odsto, ali da u svih 20 pokušaja rješava samo 241 zadatak. Prema autorima, približno četiri od pet neuspjeha potiču od rukovanja alatima, a ne od rezonovanja.
Microsoft, Hugging Faceprovjereno
