OpenAI je objavio GPT-6 Astru po 10 dolara za milion ulaznih tokena, a preduzećima je pristup isključen
Model GPT-6 Astra objavljen je 3. septembra 2026. Prvo ga je dobio ograničen broj organizacija, a narednih dana slijede i korisnici planova ChatGPT Plus, Pro, Business i Enterprise. U API-ju se zove gpt-6-astra i košta 10 dolara po milionu ulaznih i 50 dolara po milionu izlaznih tokena, a isporučuje se i preko Microsoft Azurea i Amazon Bedrocka. Preduzeća ga ne dobijaju sama od sebe, jer je pristup pri objavi podrazumijevano isključen i mora ga uključiti administrator. OpenAI uz to upozorava da dodatne bezbjednosne provjere umiju da pauziraju posao u ChatGPT-u i Codexu, a u API-ju da ga prekinu.
Izvor
GPT-6 Astra: A new generation of intelligenceOpenAI News · Original objavljen 3. septembra 2026.
OpenAI je 3. septembra 2026. objavio model GPT-6 Astra, dva dana pošto je saopštio da model dostiže kritični prag sajber sposobnosti iz njegovog okvira pripravnosti. Objava o izdanju donosi ono što je u toj najavi izostalo: cijenu, planove i uslove pod kojima će model odbiti posao ili ga prekinuti usred rada.
Koliko košta i gdje se izvršava
U API-ju cijena je 10 dolara po milionu ulaznih tokena i 50 dolara po milionu izlaznih. Za čitanje i upis keša važe posebne stope. Brzi režim obećava do dva puta veću brzinu od standardnog, po dvostrukoj standardnoj cijeni, pa se kraće čekanje plaća novcem, a ne kvalitetom odgovora.
Pristup se dodjeljuje u više koraka. Prvo ga dobija ograničen broj organizacija, a narednih dana slijede planovi ChatGPT Plus, Pro, Business i Enterprise. Potrošnja se skida sa postojeće pretplatničke kvote, a i pojedinci i firme mogu dokupiti kredite preko nje. Planovi Pro, Business i Enterprise uz to dobijaju i GPT-6 Astra Pro.
- U API-ju se model zove gpt-6-astra, a isti model se isporučuje i kroz Microsoft Azure i Amazon Bedrock.
- Administrator preduzeća mora sam da uključi Astru za svoj radni prostor, jer je pristup pri objavi podrazumijevano isključen.
- Nulto zadržavanje podataka podržano je za one kupce API-ja koji ispunjavaju uslove.
Brojke je izmjerio sam proizvođač
Na mjerilu Terminal-Bench 4.0, koje agenta stavlja u terminal i ocjenjuje poslove programiranja, podešavanja sistema i obrade podataka, OpenAI navodi 57,9 odsto za Astru, naspram 37,3 odsto za GPT-5.6 Sol i 55,8 odsto za Claude Fable 5.1. Uz to procjenjuje oko 9 odsto, odnosno oko 63 odsto nižu cijenu po zadatku. Na mjerilu Agents' Last Exam navodi 59,3 odsto, naspram 55,5 odsto za Claude Opus 5 i 53,6 odsto za Sol, uz oko 65 odsto manje izlaznih tokena nego kod Opusa 5.
Uz svaku od tih brojki idu dva ograničenja. Cijena po zadatku je procjena samog OpenAI-ja iz njegovih pokretanja, a ne račun koji je neko platio. Rezultati su najbolji pri bilo kojem stepenu truda, a to nije stepen s kojim podrazumijevana postavka radi. Zato ih treba čitati kao najpovoljniji slučaj proizvođača, a ne kao nezavisno mjerenje.
- FrontierMath Tier 4, druga verzija: tabela navodi 97,6 odsto, dok uvodni pasus iste objave taj isti rezultat zaokružuje na 98 odsto.
- ARC-AGI-3: 99,9 odsto, uz izjavu Grega Kamradta iz fondacije ARC Prize da je to praktično izjednačenje s čovjekom na tom mjerilu.
- ExploitBench: 100 odsto, naspram 78,5 odsto za GPT-5.6 Sol, izmjereno bez zaštite koja radi u proizvodnji.
Zaštita će prekinuti i ispravan posao
Ovo je dio koji je važan svakome ko planira da gradi na Astri. Verzija koja se objavljuje odbija napredne bezbjednosne zahtjeve, među njima i pisanje dokaza koncepta za ranjivost. OpenAI najavljuje blaže ograničavanje kroz program Daybreak u narednim sedmicama. Bezbjednosni pregled koda i krpljenje ranjivosti dozvoljeni su već u ovoj verziji.
Iznad odbijanja radi i sloj nadzora koji se uključuje usred zadatka. OpenAI sam navodi da dodatne bezbjednosne provjere umiju da uspore, pauziraju ili zaustave i ispravan posao. U ChatGPT-u i Codexu korisnik tada dobija zahtjev da pregleda radnju prije nastavka, a u API-ju se zadatak jednostavno prekida. Sve što se gradi nad tim API-jem mora prekinut zadatak da tretira kao redovan ishod, a ne kao izuzetak, i da ga pokaže onome ko čeka rezultat.
Sposobnost zbog koje je opreza toliko nije zamišljena. OpenAI navodi da je model tokom interne provjere nad nedavnim ranjivostima u motoru V8 pronašao i upotrijebio dvije dotad nepoznate, i da su obje prijavljene održavaocima.
„Dodatne bezbjednosne provjere umiju da uspore, pauziraju ili zaustave i ispravan posao.“
Izvori
Povezano
NeoMME sa 260 miliona parametara došao je na 0,002 od modela s 3,75 milijardi na ViDoRe v3
Kompanija H objavila je 3. septembra 2026. dva multimodalna enkodera, od 260 miliona i 800 miliona parametara, pod licencom Apache 2.0 i za učitavanje kroz biblioteku Hugging Face Transformers. Na mjerilu ViDoRe v3, koje ocjenjuje pretragu skeniranih dokumenata, manji model postiže 0,523 po mjeri nDCG@10, a to je 0,002 ispod modela ColQwen2.5 koji ima oko četrnaest puta više parametara. Isti model kodira oko 51 stranicu u sekundi na jednoj grafičkoj kartici NVIDIA L40S. Indeks koji pravi može se sabiti sa oko 1,5 megabajta po stranici na 6 kilobajta, uz zadržanih preko 95 odsto kvaliteta pretrage.
Hugging Faceprovjereno
ChatGPT, Claude, Grok i Gemini imali su smetnje u istom dvočasu, 3. septembra
Anthropic je 3. septembra 2026. zaveo povećan broj grešaka na modelima Claude Mythos 5.1, Claude Fable 5.1 i Claude Opus 5, a OpenAI povećan broj grešaka u ChatGPT-u i Codexu. Grok je korisnicima ispisivao poruku o greškama, a nezavisni nadzor je zabilježio vjerovatan prekid Gemini API-ja. Četiri nezavisna provajdera, jedno prijepodne. Nijedna stranica o stanju usluga ne imenuje zajednički uzrok, a Amazon Web Services, Microsoft Azure i Cloudflare tog jutra nisu prijavili veće smetnje.
Ars Technicaprovjereno
Googleov WeatherNext 3 računa prognozu svakog sata, a programeri je čitaju iz BigQueryja
Google DeepMind i Google Research objavili su WeatherNext 3 dana 3. septembra 2026. Model uči iz mozaika geostacionarnih satelita uživo, a ne samo iz fizičkih simulacija koje kasne šest sati, pa novu prognozu daje svakog sata umjesto svakih šest. Temperatura i vlaga izlaze na mreži od pet kilometara, dok je prethodni model radio na 25 kilometara. Podaci se od dana objave čitaju u okruženjima BigQuery i Earth Engine, pa je ovo izdanje na kojem se može graditi, a ne samo rad koji se čita.
Google DeepMindprovjereno


