OpenAI je Astru svrstao u kritičnu sajber kategoriju, a zaštita zaustavlja i ispravan posao
OpenAI saopštava da još neobjavljeni model Astra dostiže kritični prag sajber sposobnosti iz njegovog okvira pripravnosti, kao prvi model koji je tako označen. Na testiranju je model našao dotad nepoznate ranjivosti u ojačanom pregledaču i operativnom sistemu i povezao ih u upotrebljive napade. Dio razvoja i objave je odložen dok se zaštita nije pojačala. Van laboratorije je najvažnija napomena o postavljanju: novi nadzor umije da zaustavi i posao koji s bezbjednošću nema veze.
Izvor
Path to Astra: critical capabilities and frontier safeguardsOpenAI News · Original objavljen 1. septembra 2026.
OpenAI je 1. septembra 2026. objavio ocjenu modela Astra, prije nego što je sam model izašao. Kompanija sada smatra da Astra dostiže kritični prag sajber sposobnosti iz njenog okvira pripravnosti. Taj prag opisuje kao sposobnost da se pronađu dotad nepoznate bezbjednosne slabosti i da se za njih naprave načini iskorišćavanja. Podrazumijeva se da to važi na mnogim dobro zaštićenim sistemima i bez čovjeka koji vodi svaki korak. Astra je prvi model koji je OpenAI postavio na taj nivo.
Šta ta oznaka znači
Okvir pripravnosti kritični prag određuje s dva uslova, od kojih je dovoljan jedan. Prvi je model koji bez ljudske intervencije umije da pronađe i razvije upotrebljive napade nultog dana svih nivoa ozbiljnosti u mnogim ojačanim stvarnim sistemima. Drugi je model koji iz samo opšte zadatog cilja osmisli i sprovede potpuno nove napade na dobro zaštićene mete. OpenAI navodi da je ocjenu izveo iz javnih i internih automatskih mjerila i iz procjena stručnjaka.
Oznaka je odluka kompanije o sopstvenom modelu, a ne nalaz spoljne revizije. Nezavisna potvrda ovih rezultata nije objavljena, a OpenAI najavljuje da će potpuniji prikaz provjera bezbjednosti i usklađenosti izaći u kartici modela na dan objave.
Šta je Astra uradila na testiranju
Objavljeni rezultati su dovoljno određeni da se kasnije mogu provjeriti, što je više nego što nudi većina tvrdnji o sposobnostima. OpenAI uz njih navodi i ograničenje koje se lako previdi: brojke za Astru odgovaraju pristupu kroz program Daybreak Blue, a ne podrazumijevanoj proizvodnoj postavci.
Kompanija navodi sljedeće nalaze.
- Na mjerilu ExploitBench, koje mjeri pisanje napada za već poznate ranjivosti, Astra je postigla 100 odsto.
- Na internom skupu od 20 nedavno objavljenih ranjivosti visoke ozbiljnosti u motoru V8 model je češće postizao izvršavanje proizvoljnog koda nego GPT-5.6 Sol, i to uz osjetno manje izlaznih tokena. Taj skup je sastavljen da se izbjegne zagađenje mjerila.
- Tokom te provjere je pronašao i upotrijebio dvije ranjivosti nultog dana kao dio lanca napada, a OpenAI navodi da ih prijavljuje održavaocima.
- Na ojačanom pregledaču je sastavio potpun lanac kojim je izašao iz izolovanog okruženja i izvršio komande na domaćinu čim je pregledač otvorio pripremljenu HTML datoteku. Na ojačanom operativnom sistemu je više slabosti povezao u podizanje ovlašćenja s običnog korisnika na administratorski nalog.
Šta je promijenjeno poslije upada u Hugging Face
OpenAI navodi da Astra u tom upadu nije učestvovala i da naknadno testiranje pokazuje kako bi ga tadašnja proizvodna zaštita spriječila. Kompanija je ipak na dvije sedmice zaustavila dio obuke naprednih modela i za to vrijeme pojačala infrastrukturu za treniranje, uključujući izolaciju i mrežnu kontrolu, širi nadzor i strože pragove usklađenosti. Veliko treniranje potkrepljenim učenjem, koje je bilo zadržano, ponovo je pokrenuto 28. avgusta 2026. Manji ogledi su i dalje zaustavljeni.
Na nivou samog modela OpenAI navodi da Astra odbija 91,5 odsto zahtjeva iz njegovog skupa testova za zaobilaženje zaštite, prema 59 odsto koliko odbija GPT-5.6 Sol. Opisuje i test s mamcem, izveden iz istog upada, u kojem je GPT-5.6 Sol bez proizvodne zaštite pokušao da dopre do meta van zadatka u 56 odsto pokretanja, dok Astra to nije pokušala nijednom. Te brojke opisuju ponašanje u uslovima ispitivanja i s isključenom zaštitom, što kompanija izričito naglašava.
Šta to košta onoga ko model koristi
Pristup naprednim sajber poslovima na Astri prvo dobija mala grupa alfa-testera, a kasnije se širi kroz program Daybreak Blue za odbrambenu upotrebu. OpenAI očekuje da će zaštita na početku smetati više nego što je namjera.
Konkretna posljedica je u napomeni o postavljanju. Sistem umije da ispravan rad označi kao moguću zloupotrebu ili neovlašćeno ponašanje, uključujući poslove koji s bezbjednošću nemaju očiglednu vezu i agente koji rade duže vrijeme. U ChatGPT-u i Codexu korisnik tada dobija pitanje da pregleda radnju prije nego što se nastavi. Na API-ju takvog pitanja nema, nego se zadatak prekida. Ko na modelu te klase gradi cjevovod bez nadzora, prekid mora da računa kao uobičajen ishod, a ne kao grešku.
„Dodatne bezbjednosne provjere ponekad uspore, zaustave ili prekinu ispravan posao“
Povezano
NeoMME sa 260 miliona parametara došao je na 0,002 od modela s 3,75 milijardi na ViDoRe v3
Kompanija H objavila je 3. septembra 2026. dva multimodalna enkodera, od 260 miliona i 800 miliona parametara, pod licencom Apache 2.0 i za učitavanje kroz biblioteku Hugging Face Transformers. Na mjerilu ViDoRe v3, koje ocjenjuje pretragu skeniranih dokumenata, manji model postiže 0,523 po mjeri nDCG@10, a to je 0,002 ispod modela ColQwen2.5 koji ima oko četrnaest puta više parametara. Isti model kodira oko 51 stranicu u sekundi na jednoj grafičkoj kartici NVIDIA L40S. Indeks koji pravi može se sabiti sa oko 1,5 megabajta po stranici na 6 kilobajta, uz zadržanih preko 95 odsto kvaliteta pretrage.
Hugging Faceprovjereno
ChatGPT, Claude, Grok i Gemini imali su smetnje u istom dvočasu, 3. septembra
Anthropic je 3. septembra 2026. zaveo povećan broj grešaka na modelima Claude Mythos 5.1, Claude Fable 5.1 i Claude Opus 5, a OpenAI povećan broj grešaka u ChatGPT-u i Codexu. Grok je korisnicima ispisivao poruku o greškama, a nezavisni nadzor je zabilježio vjerovatan prekid Gemini API-ja. Četiri nezavisna provajdera, jedno prijepodne. Nijedna stranica o stanju usluga ne imenuje zajednički uzrok, a Amazon Web Services, Microsoft Azure i Cloudflare tog jutra nisu prijavili veće smetnje.
Ars Technicaprovjereno
OpenAI je objavio GPT-6 Astru po 10 dolara za milion ulaznih tokena, a preduzećima je pristup isključen
Model GPT-6 Astra objavljen je 3. septembra 2026. Prvo ga je dobio ograničen broj organizacija, a narednih dana slijede i korisnici planova ChatGPT Plus, Pro, Business i Enterprise. U API-ju se zove gpt-6-astra i košta 10 dolara po milionu ulaznih i 50 dolara po milionu izlaznih tokena, a isporučuje se i preko Microsoft Azurea i Amazon Bedrocka. Preduzeća ga ne dobijaju sama od sebe, jer je pristup pri objavi podrazumijevano isključen i mora ga uključiti administrator. OpenAI uz to upozorava da dodatne bezbjednosne provjere umiju da pauziraju posao u ChatGPT-u i Codexu, a u API-ju da ga prekinu.
OpenAIprovjereno


