OpenAI je objavio GPT-6 Sol i GPT-6 Luna i upola snizio cijenu oba modela
GPT-6 Sol košta 2 dolara po milionu ulaznih i 10 dolara po milionu izlaznih tokena, a GPT-6 Luna 0,10 i 0,50 dolara. Sniženje od 50 odsto OpenAI računa u odnosu na promotivne cijene modela GPT-5.6. Uz modele je stiglo i preuređeno keširanje promptova, s popustom do 90 odsto na keširane ulazne tokene. Sva poređenja s Claudeom potiču od kompanije OpenAI i vode se prema Opusu 5, a ne prema Opusu 5.5.
OpenAI je 22. septembra 2026. objavio dva manja modela iz porodice GPT-6. Novi Sol zamjenjuje model GPT-5.6 Sol, a nova Luna model GPT-5.6 Luna. U API-ju se pozivaju kao gpt-6-sol i gpt-6-luna. Kompanija navodi da joj je najjači model i dalje GPT-6 Astra, objavljen 3. septembra 2026.
Koliko modeli koštaju
Sol košta 2 dolara po milionu ulaznih i 10 dolara po milionu izlaznih tokena. Luna košta 0,10 dolara po milionu ulaznih i 0,50 dolara po milionu izlaznih tokena. Prethodnici su koštali 4 i 20 dolara, odnosno 0,20 i 1,20 dolara, pa OpenAI oba nova modela predstavlja kao 50 odsto jeftinija.
Uz tu brojku idu dvije pojedinosti. OpenAI nove cijene poredi s cijenama koje sam naziva promotivnim cijenama modela GPT-5.6, a ne s redovnim cjenovnikom. Izlazna cijena Lune pala je i za više od polovine: sa 1,20 na 0,50 dolara, što je prema računu redakcije sniženje od 58 odsto.
Keš koji zajednički kontekst čuva 30 minuta
OpenAI je za porodicu GPT-6 preuredio i keširanje promptova. Keširani ulazni tokeni jeftiniji su do 90 odsto, a zajednički početni dio prompta dobija popust ako se ponovo upotrijebi u roku od 30 minuta. Kompanija navodi da novi sistem češće pogađa keš i bez ikakve izmjene na strani programera.
Izmjena je najvažnija za agente, jer oni uz svaki zahtjev ponovo šalju ista uputstva, opise alata i ranije korake razgovora. Na modelima GPT-6 nivo rezonovanja sada može da se promijeni između dva odgovora, porukom configuration_update, a da se keš ne izgubi. OpenAI preporučuje da opisi alata ostanu nepromijenjeni i da se spisak dostupnih alata suzi parametrom allowed_tools ili isključi vrijednošću none u polju tool_choice, umjesto da se opisi brišu.
GitHub, kog OpenAI citira, navodi da je za nekoliko mjeseci udio tokena iz promptova koje je trebalo obraditi iznova smanjen za više od 50 odsto, na milijardama zahtjeva prema modelima kompanije OpenAI.
- Pregled keširanja (Prompt Caching Dashboard) pokazuje koliki se dio ulaza kroz vrijeme služi iz keša.
- Alat za dijagnostiku poredi zahtjev s nedavnim odgovorom i navodi izmjenu zbog koje keš nije upotrijebljen.
- Izričite tačke prekida određuju gdje se završava dio prompta koji se kešira.
- Prethodno zagrijavanje keša obrađuje poznat kontekst, na primjer zajednička uputstva, prije nego što stigne prvi zahtjev korisnika.
Šta tvrde mjerenja same kompanije
Sva poređenja u objavi potiču od kompanije OpenAI. Na testu AutomationBench, koji mjeri poslovne tokove rada kroz 47 alata, OpenAI za Sol pri nivou rezonovanja xhigh navodi 33,2 odsto uz 0,27 dolara po zadatku. Claude Opus 5 pri najvišem nivou, prema istoj tabeli, postiže 26,9 odsto, a trošak po zadatku mu je 11,1 put veći.
Na testu DeepSWE v1.1 kompanija za Sol pri najvišem nivou navodi 68,8 odsto, a za Claude Fable 5 pri nivou xhigh 69,9 odsto, pri čemu je Sol po zadatku otprilike 80 odsto jeftiniji. Luna pri najvišem nivou postiže 66,6 odsto. Na testu OSWorld 2.0 Sol pri nivou xhigh prema kompaniji postiže 60,5 odsto, a Opus 5 pri srednjem nivou 60,3 odsto.
Na internom testu tačnosti, sastavljenom od razgovora u kojima su korisnici prijavili grešku, OpenAI navodi da Sol pravi otprilike upola manje grešaka od prethodnika. Kompanija i sama napominje da ti razgovori ne predstavljaju uobičajenu upotrebu.
Šta poređenje izostavlja
Anthropic je 22. septembra 2026. objavio Claude Opus 5.5, po cijeni od 4 dolara po milionu ulaznih i 20 dolara po milionu izlaznih tokena. Nijedna tabela kompanije OpenAI ga ne sadrži, jer se Sol poredi s modelima Opus 5, Fable 5.1 i Fable 5. Po cijeni tokena Sol je upola jeftiniji od Opusa 5.5, i na ulazu i na izlazu. Ovo ukazuje na to da je razlika u trošku po zadatku manja nego u tabelama, jer je i Opus 5.5 jeftiniji od Opusa 5, ali to nijedno javno mjerenje zasad ne potvrđuje.
Gdje su modeli dostupni
U okruženjima ChatGPT Work i Codex oba modela dobijaju korisnici planova Plus, Pro, Business, Enterprise i Edu. Korisnici planova Free i Go dobijaju model GPT-6 Luna u aplikaciji za računar. Prema kompaniji, modeli zasad nisu dostupni u okruženju Chat i uvode se postepeno.
„Poboljšanja keširanja i izvođenja omogućavaju nam da ove modele nudimo jeftinije.“
Izvori
Povezano
Anthropic je objavio Sonnet 5.5, čiji ulazni i izlazni tokeni koštaju upola manje nego kod Opusa 5.5
Claude Sonnet 5.5 zadržava cijene Sonneta 5: dva dolara po milionu ulaznih i deset dolara po milionu izlaznih tokena. To je upola manje nego kod Opusa 5.5, a prema testovima samog Anthropica dva modela dijeli svega nekoliko poena. Kod koji isključuje razmišljanje mora se izmijeniti prije prelaska, jer staro podešavanje sada vraća grešku.
Anthropicprovjereno
Firma H Company objavila je otvorene težine modela Holo4 za agente koji upravljaju računarom
H Company je 28. septembra 2026. objavila dva modela Holo4, s težinama na Hugging Faceu. Veći model postiže bolje rezultate na testovima same kompanije, ali ne smije da se koristi komercijalno. Manji model je objavljen pod licencom Apache 2.0.
Hugging Faceprovjereno
Anthropic je objavio Opus 5.5 i snizio cijenu tokena za petinu
Opus 5.5 košta četiri dolara po milionu ulaznih i dvadeset dolara po milionu izlaznih tokena, dvadeset odsto manje nego Opus 5. Čitanje keša, na koje u agentskom radu i pisanju koda odlazi najveći dio računa, pojeftinilo je za 60 odsto, na 0,20 dolara po milionu. Anthropic navodi da model na većini poslova radi na nivou modela Claude Fable 5.1, a da košta 40 odsto manje od Opusa 5. Uz model idu i zaštite koje većinu poslova iz oblasti kibernetičke bezbjednosti preusmjeravaju na Opus 4.8.
Anthropicprovjereno



