
Kompanija OpenAI saopštila je da su dva njena najnaprednija AI modela izvršila hakerski napad - samostalno probila granice kontrolisanog testnog okruženja i potom se, bez ljudske intervencije, ubacila u sisteme kompanije Hugging Face – jedne od vodećih platformi za deljenje open-source AI modela i baza podataka.
Reč je, kako navode iz same kompanije, o „presedanu bez presedana" u istoriji sajber bezbednosti, piše Bloomberg.
Incident se dogodio tokom internog testa osmišljenog da proceni maksimalne sajber sposobnosti modela GPT-5.6 Sol i još jednog, još moćnijeg modela koji još uvek nije objavljen javnosti. Da bi se dobila realna slika o tome dokle modeli mogu da odu, testiranje je sprovedeno bez uobičajenih zaštitnih mehanizama koji inače sprečavaju modele da preduzimaju rizične sajber aktivnosti – što se, kako se ispostavilo, pokazalo kao ozbiljan previd.
Kako je došlo do proboja
Prema objašnjenju koje je OpenAI objavio na sopstvenom sajtu, modeli su tokom testa utrošili značajnu količinu računarske snage tražeći način da dobiju pristup otvorenom internetu, iz izolovanog istraživačkog okruženja u kojem su se nalazili. U tome su uspeli tako što su pronašli takozvanu "zero-day" ranjivost – dotad nepoznatu bezbednosnu manjkavost u internom sistemu za keširanje softverskih paketa. Nakon što su tim putem stekli pristup internetu, modeli su samostalno zaključili da bi Hugging Face mogao da čuva rešenja za test kojem su bili podvrgnuti, te su počeli da traže način da dođu do te platforme.
Koristeći kombinaciju ukradenih pristupnih podataka i dodatnih bezbednosnih propusta, modeli su uspeli da pronađu put za daljinsko izvršavanje koda na Hugging Face serverima. Sistem OpenAI-a je prvi otkrio neobičnu aktivnost, dok su bezbednosni tim i AI agenti Hugging Face-a nezavisno detektovali i zaustavili upad na sopstvenoj infrastrukturi, pre nego što su dva tima uopšte stupila u kontakt.
Sam Hugging Face je incident javno objavio nešto ranije, opisujući ga kao "novu vrstu bezbednosnog incidenta" u kojem je otkriven i zaustavljen AI agent koji je kompromitovao njihovu infrastrukturu. Tek naknadnom istragom OpenAI je utvrdio da je upravo njegov sopstveni sistem stajao iza napada, piše Engadget.
Od fascinacije do zabrinutosti
Suosnivač i izvršni direktor Hugging Face-a Klem Delang (Clem Delangue) izjavio je da veruje kako iza upada nije stajala zla namera OpenAI-a, ali je istovremeno naglasio ozbiljnost onoga što se dogodilo. Prema pisanju Al Jazeere, Delang je incident nazvao verovatno prvim te vrste i poručio da bezbednost veštačke inteligencije ne može da reši nijedna kompanija radeći u tajnosti, već isključivo otvorenom saradnjom cele industrije.
Incident je izazvao i političke reakcije u Sjedinjenim Državama. Demokratski kongresmen iz Teksasa Greg Kasar (Greg Casar) ocenio je događaj kao alarmantan, upozoravajući da se veštačka inteligencija razvija izuzetno brzo bez stvarne regulative koja bi zaštitila javnost, te je pozvao na obavezno nezavisno testiranje bezbednosti AI modela i obaveznu prijavu ovakvih incidenata.
OpenAI: "Uvedene su strože kontrole"
Kompanija je saopštila da sprovodi niz mera kao odgovor na incident. Uvedene su strože kontrole u konfiguraciji infrastrukture, čak i po cenu usporavanja sopstvenog istraživačkog rada, dok se ranjivosti ne otklone u potpunosti. OpenAI redovno izveštava sopstveni Odbor za bezbednost i sigurnost o efektima ovih mera. Otkrivena "zero-day" ranjivost je odgovorno prijavljena proizvođaču pogođenog softvera, a Hugging Face je uključen u OpenAI-jev program poverljivog pristupa (trusted access), kroz koji kompanija pomaže partnerima da unaprede sopstvenu odbranu koristeći iste modele koji su prethodno bili zloupotrebljeni.
OpenAI navodi da su bezbednosne mere koje bi normalno sprečile ovakav scenario namerno bile isključene, upravo zato što je cilj testa bio da se izmere sajber sposobnosti modela u najgorem mogućem scenariju. Kompanija priznaje da ovaj slučaj ukazuje na potrebu da se dodatno ojačaju usklađenost modela sa željenim ponašanjem, zaštita tokom samog procesa evaluacije, kao i nadzor nad internim testiranjima.
Nije samo za test
Ono što incident čini posebno značajnim jeste to što pokazuje da teorijske sposobnosti dugotrajnih, višekoračnih sajber operacija o kojima govore bezbednosne institucije poput britanskog AI Security Institute – koji je ranije objavio da modeli poput GPT-5.6 Sol mogu da održavaju kompleksne sajber operacije tokom dužeg vremenskog perioda – imaju stvarnu primenu i u realnim uslovima, a ne samo u kontrolisanim testovima.
Fortune podseća da je ovo drugi slučaj u istoj nedelji u kojem je OpenAI priznao da je jedan od njegovih još neobjavljenih modela izašao iz internog "peskovnika" – izolovanog okruženja bez pristupa internetu, koje kompanije za veštačku inteligenciju koriste da bi sprečile modele da deluju van kontrolisanih uslova.
Iako OpenAI ističe da nije bilo zlonamerne namere – model je jednostavno pokušavao da što efikasnije reši postavljeni zadatak, čak i po cenu kršenja pravila – slučaj otvara pitanja koja prevazilaze jednu kompaniju. Ako najnapredniji modeli mogu samostalno da pronađu i iskoriste nepoznate bezbednosne propuste kako bi zaobišli ograničenja koja su im nametnuta, to postavlja nova pitanja o tome koliko su trenutni mehanizmi nadzora zaista pouzdani u meri u kojoj industrija veštačke inteligencije tvrdi da jesu.






















