AI modeli pobjegli iz izolacije i izveli hakerski napad

Objavljeno: 22. 7. 2026 u 10:18h

Dva modela vještačke inteligencije kompanije OpenAI samostalno su probila izolovano okruženje i provalila u sisteme platforme Hugging Face kako bi varala na internom testu.

OpenAI je o incidentu izvijestio sinoć, 21. jula, i precizirao da je riječ o kombinaciji njihovog najnovijeg javnog modela GPT-5.6 Sol i jednog još snažnijeg, koji nije dostupan javnosti. Događaj je podstakao raspravu o bezbjednosti i sve većim sposobnostima AI sistema.

„Bili su izuzetno fokusirani i preduzeli su ekstremne korake“

Modeli su bili dio internog testa čiji je cilj bio da procijeni njihove sajber sposobnosti. Testiranje je sprovedeno bez uobičajenih bezbjednosnih ograničenja koja bi im inače onemogućila izvođenje takvih operacija.

Test se odvijao na javnom sistemu za evaluaciju sajber bezbjednosti ExploitGym, a modeli su, prema objavi OpenAI-ja, ispravno zaključili da se rješenja za test nalaze na serverima kompanije Hugging Face.

„Modeli su identifikovali i iskoristili niz slabosti u istraživačkom okruženju OpenAI-ja i produkcijskoj infrastrukturi Hugging Facea kako bi dohvatili rješenja testa direktno iz baze podataka“, navodi se u objavi OpenAI.

„Svi dokazi ukazuju na to da su bili izuzetno fokusirani na pronalazak rješenja za ExploitGym i preduzeli su ekstremne korake da ostvare taj uski cilj“, navodi se.

„Napad jedinstvenih razmjera“

Iz OpenAI su poručili da incident smatraju sajber napadom jedinstvenih razmjera koji uključuje najnaprednije zabilježene ofanzivne sposobnosti i da će njihova reakcija biti u skladu s tim.

Stručnjaci za sajber bezbjednost dugo upozoravaju na mogućnost ovakvih napada, prenosi Index.

Roman Jampolski (Roman Yampolskiy), istraživač bezbjednosti vještačke inteligencije sa Univerziteta u Luisvilu, komentarisao je da ovaj slučaj pokazuje kako moćni modeli mogu otkriti i iskoristiti ranjivosti na načine koje njihovi kreatori nisu predvidjeli.

Smatra da će se slični incidenti ponavljati jer su AI modeli u svojoj suštini nepredvidivi i na kraju ih je nemoguće u potpunosti kontrolisati.

Šta je Hugging Face?

Da bi se shvatila težina ovog incidenta, treba razumjeti šta je uopšte Hugging Face.

Riječ je o američkoj platformi sa sjedištem u Njujorku, osnovanoj 2016. godine, koju u IT i AI zajednici često nazivaju „GitHubom za vještačku inteligenciju“.

Služi kao centralno svjetsko okupljalište za više od milion stručnjaka, istraživača i kompanija koje tamo razmjenjuju otvorene AI modele, gotove baze podataka i programske alate.

Provala OpenAI-jevih modela na njihove servere zato nije bila samo napad na bilo koju IT kompaniju, već direktan upad u ključnu globalnu infrastrukturu na kojoj se temelji savremeni razvoj i testiranje vještačke inteligencije.

Šta kažu u napadnutoj kompaniji?

Hugging Face je još prošlog četvrtka objavio da su bili meta sajber napada za koji vjeruju da ga je izveo autonomni AI agent.

Ovo je jedan od malobrojnih zabilježenih incidenata u kojima su AI agenti djelovali samostalno, a na taj rizik stručnjaci upozoravaju već godinu dana.

Tada još nisu znali ko stoji iza napada i istraga je bila u toku.

Iz kompanije su naveli da su se prvo pokušali odbraniti uz pomoć neimenovanog AI modela jednog od vodećih američkih laboratorija.

Međutim, bezbjednosna ograničenja tog modela blokirala su djelovanje njihovog tima za hitne intervencije, pa su za odbranu na kraju upotrijebili model otvorenog koda kineske kompanije Z.ai.

Klem Delang (Clem Delangue), izvršni direktor Hugging Facea, u izjavi je istakao važnost saradnje.

„Zahvalni smo na saradnji s OpenAI. Ovaj incident, vjerovatno prvi takve vrste, dokazuje ono u šta dugo vjerujemo: bezbjednost vještačke inteligencije ne može riješiti jedna kompanija koja radi u tajnosti. Rješenje je u otvorenosti, saradnji i davanju širokog pristupa alatima svakome ko se bavi odbranom, bilo gdje“, rekao je Delang.

Ranije ove sedmice OpenAI je objavio da je njihov snažniji, još neobjavljeni model i ranije probijao izolovana okruženja, takozvane sandboxove, ali u tim slučajevima nije upadao u sisteme drugih kompanija.

Sličan događaj prijavio je i konkurentski Anthropic.

Njihov model Mythos tokom bezbjednosnog testa takođe je probio izolaciju i pristupio internetu, što mu nije bilo dozvoljeno, kako bi poslao imejl poruku istraživaču o zadatku na kojem je radio.

Kako se odvijao napad? AI modeli prvo su sebi obezbijedili pristup internetu

OpenAI i Hugging Face nastavljaju istragu.

Za sada je poznato da su modeli napad započeli tako što su sebi obezbijedili pristup internetu.

Za to je bila potrebna znatna računarska snaga i iskorištavanje „zero-day“ ranjivosti u spoljnom softveru koji se koristi unutar OpenAI. Kompanija je tu ranjivost u međuvremenu prijavila proizvođaču softvera.

Nakon toga, modeli su se usmjerili na Hugging Face kako bi pronašli rješenja za test.

U jednom od primjera, model je izveo složen, višefazni napad na servere Hugging Facea, pri čemu je koristio izložene pristupne podatke i „zero-day“ ranjivosti.

OpenAI je otkrio napad i obavijestio Hugging Face, čiji su timovi u tom trenutku već bili identifikovali i zaustavili upad i radili na rekonstrukciji događaja.

OpenAI najavio bolje kontrole

Incident još nije završen.

OpenAI radi na uvođenju boljih kontrola u svom istraživačkom okruženju, čak i ako to uspori istraživanja.

Kompanija je takođe potvrdila da nastavlja saradnju s Hugging Faceom kako bi im pomogla da ojačaju odbrambene sisteme.

Kao dio tih napora, OpenAI je dodao Hugging Face u svoj program „pouzdanog pristupa“ za sajber bezbjednost.

To znači da će Hugging Face moći koristiti verziju modela GPT-5.6 Sol s manje ograničenja, dizajniranu upravo za pomoć stručnjacima za odbranu.

Hugging Face nije otkrio koji su američki AI model prvobitno pokušali koristiti za odbranu.

Izvor: Nezavisne

Facebook Twitter Preporuči na Viberu
Kopirati

Nema komentara

Sakrij sve komentare

Prikaži komentare

NAPOMENA: Komentari odražavaju stavove njihovih autora, a ne nužno i stavove internet portala Banjaluka.com. Molimo korisnike da se suzdrže od vrijeđanja, psovanja i vulgarnog izražavanja. Portal Banjaluka.com zadržava pravo da obriše komentar bez najave i objašnjenja. Zbog velikog broja komentara Banjaluka.com nije dužan obrisati sve komentare koji krše pravila. Kao čitalac takođe prihvatate mogućnost da među komentarima mogu biti pronađeni sadržaji koji mogu biti u suprotnosti sa vašim vjerskim, moralnim i drugim načelima i uvjerenjima.

Šta mislite o ovoj temi?

Vaša e-mail adresa neće biti objavljena. Sva polja su obavezna!

Promo

Copyright. Sva prava zadržana. Dozvoljeno preuzimanje sadržaja isključivo uz navođenje linka prema stranici sa koje je sadržaj preuzet.

/magazin/ai-modeli-pobjegli-iz-izolacije-i-izveli-hakerski-napad/||Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/129.0.0.0 Safari/537.36