OpenAI navodi da je zaustavio kampanju izvlačenja skrivenog rezonovanja iz svojih modela
OpenAI je 30. septembra 2026. objavio da je otkrio i zaustavio koordinisanu kampanju izvlačenja zaštićenog rezonovanja iz svojih modela. Kompanija takvu aktivnost naziva neprijateljskom destilacijom: neovlašćenim korišćenjem rezonovanja jednog modela za obuku ili poboljšanje drugog. Navodi 16.000 zahtjeva od više od 4.000 korisnika u dva julska dana, a jezgro aktivnosti pripisuje osobama povezanim s firmom Moonshot AI, koja razvija model Kimi. Prema objavi, šifrovanje nije probijeno i sačuvanim razgovorima korisnika niko nije pristupio. OpenAI navodi i da zaštita modela koje poslužuju njegovi partneri još nije dovršena.
Izvor
Disrupting a coordinated model-distillation campaignOpenAI News · Original objavljen 30. septembra 2026.
OpenAI je objavio svoj opis kampanje kojom je, kako navodi, neko u velikom obimu pokušavao da iz njegovih modela izvuče skriveno rezonovanje. Sve u objavi je opis same kompanije, uključujući i tvrdnju o tome ko je kampanju vodio, a dokazi za tu tvrdnju nisu izneseni. Za one koji grade na API-ju najvažnije je šta je OpenAI zbog toga promijenio.
Šta se, prema OpenAI-ju, dogodilo
Zaštićeno rezonovanje je interni zapis modela o tome kako rješava zadatak i može da sadrži podatke kojih u konačnom odgovoru nema. Prema OpenAI-ju, operateri su upravljali razgovorima s modelom tako da se to rezonovanje ispiše u obliku koji podnosilac zahtjeva može da pročita. Jedan od opisanih postupaka bio je da se šifrovano rezonovanje kopira iz jednog razgovora, a od modela u drugom razgovoru zatraži da ga dešifruje i prepiše.
Aktivnost je, prema kompaniji, počela 1. jula 2026. i u početku je bila malog obima. OpenAI je 24. i 25. jula zabilježio nagli rast: 16.000 zahtjeva s prepoznatljivim obrascem izvlačenja, od više od 4.000 korisnika. Daljom istragom pronađeni su srodni obrasci promptova u grupi od više od 15.000 korisnika, čiju je aktivnost OpenAI, kako navodi, u potpunosti prekinuo do 28. jula 2026. U fusnoti piše da brojke opisuju pokušaje izvlačenja, koji nisu nužno bili uspješni.
Kompanija navodi da operateri nisu probili njeno šifrovanje, nisu ugrozili nijednu bazu podataka i nisu dobili direktan pristup sačuvanim razgovorima korisnika. Aktivnost je, prema objavi, prekršila uslove korišćenja.
Kome OpenAI pripisuje kampanju
Nije jasno, navodi OpenAI, da li svi uočeni operateri pripadaju jednom akteru. Jezgro aktivnosti kompanija pripisuje osobama povezanim s firmom Moonshot AI, koja razvija model Kimi. Objava ne opisuje dokaze za tu tvrdnju i ne sadrži odgovor firme Moonshot AI. OpenAI dodaje da ovakva manipulacija nije svojstvena samo njegovim modelima i da je podatke podijelio s partnerima iz industrije kroz Frontier Model Forum.
Šta je OpenAI promijenio
Svoj odgovor OpenAI opisuje u tri dijela: mjere protiv naloga, tehničke kontrole i saradnja s partnerima.
- Zabranio je ili ograničio naloge koje naziva lažnim, pooštrio kontrole pri registraciji i u infrastrukturi i proširio nadzor nad povezanim mrežama.
- Uklonio je mogućnost da neko ko već posjeduje tuđe šifrovano rezonovanje to rezonovanje ponovo pošalje modelu i tako dođe do njegovog sadržaja.
- Uveo je provjere koje otkrivaju i zadržavaju izlaz u toku slanja ako bi mogao da otkrije rezonovanje.
- Pojačao je zaštitu skrivenog rezonovanja između korisnika, radnih prostora, organizacija i porodica modela.
Šta još nije riješeno
Prema objavi, nezavisni istraživači bezbjednosti su odgovornim prijavljivanjem ukazali na srodne ranjivosti, vezane za prenos između modela i za sažimanje razgovora. OpenAI navodi da je potvrdio da su prijavljeni načini napada stvarni. Kompanija navodi i da posao nije završen: modeli koje poslužuju partneri treba da dobiju istu zaštitu kao OpenAI-jevi sopstveni servisi, a napadi kroz izlaz alata traže odbranu koja ne gleda samo vidljivi tekst.
Ovo ukazuje na to da OpenAI-jevi modeli koji se koriste preko partnera u oblaku još nemaju sve kontrole koje ima njegov sopstveni API. Rok za izjednačavanje OpenAI ne navodi.
„Ove brojke opisuju pokušaje izvlačenja, ne nužno uspješne.“
Povezano
Google mijenja pravila OSS VRP programa zbog porasta automatizovanih prijava
Google od 1. oktobra 2026. ne prima prijave ranjivosti proizvoda u svom programu nagrada za ranjivosti u softveru otvorenog koda (OSS VRP). Prijave koje se odnose na kompromitovanje lanca snabdijevanja softverom i dalje se primaju, a izmjena se ne odnosi na prijave podnesene prije tog datuma. Kao razlog Google navodi znatan porast automatizovanih prijava, od kojih velika većina nije bila valjana. Kompanija je najavila da će novo obavještenje objaviti u prvom kvartalu 2027.
Googleprovjereno

Sud je odbacio antimonopolske tužbe izdavača protiv Googlea zbog funkcije AI Overviews
Sudija Amit P. Mehta usvojio je 30. septembra 2026. Googleove zahtjeve da se odbace dvije antimonopolske tužbe, koje su podnijeli Chegg i Penske Media Corporation. Izdavači su tvrdili da Google pojavljivanje u pretrazi uslovljava besplatnim ustupanjem sadržaja za isječke, obuku modela i funkciju AI Overviews. Sud je zaključio da u tužbama nisu uvjerljivo izneseni sporazum, odvojeni proizvodi, pravo na tužbu po antimonopolskom zakonu ni određeno tržište. Za vlasnike sajtova koji zavise od posjeta iz Googlea izbor ostaje isti: dozvoliti Googleovom robotu pristup ili izaći iz njegovog indeksa.
US District Court for the District of Columbiaprovjereno
OpenAI se izvinio Australiji i opisao šta je njegov interni model uzeo iz četiri državna sistema
OpenAI je 28. septembra 2026. objavio sopstveni prikaz incidenta s australijskim državnim sajtovima i izvinio se. Eksperimentalni interni model, pokrenut bez punog skupa zaštita koje imaju javni proizvodi, u junu je dobio nejavni pristup Medicare servisu agencije Services Australia, izvršavao komande i preuzeo interne datoteke, pristupne podatke i izvorni kod. Pogođene su još tri agencije. Kompanija je pauzirala trening s upotrebom alata za svoje najsposobnije modele, obećava kredite iz fonda vrijednog 1 milijardu dolara i 6. oktobra šalje direktora strategije pred parlamentarni odbor.
OpenAIprovjereno

