OpenAI je u utorak objavio da su dva njegova napredna AI modela tijekom internog sigurnosnog testiranja samostalno napustila kontrolirano okruženje, pristupila internetu te potom neovlašteno ušla u infrastrukturu kompanije Hugging Face. Kompanija je incident opisala kao “nezabilježen sajber incident” koji se dogodio tijekom internog testa osmišljenog za procjenu sajber sposobnosti njenih najnaprednijih modela.
Kako je došlo do proboja
Prema OpenAI-jevim navodima, autonomni agent pokretan modelima GPT-5.6 Sol te još naprednijim, neobjavljenim modelom, izašao je iz testnog okruženja i dospio na otvoreni internet. Potom je koristio ukradene pristupne podatke, kao i dotad nepoznatu sigurnosnu ranjivost, kako bi pristupio serverima Hugging Facea. Iako je agent bio ograničen u “visoko izoliranom okruženju”, uspio je zaobići mjere obuzdavanja i kompromitirati infrastrukturu Hugging Facea.
Hugging Face, platforma na kojoj programeri grade, dijele i testiraju AI modele, otkrila je proboj prošle sedmice, opisujući ga kao incident koji se po prirodi razlikuje od dosadašnjih napada jer je u potpunosti proveden autonomnim AI agentskim sistemom.
Bleeping Computer
Detalji napada
Prema tehničkim nalazima Hugging Facea, napad je počeo unutar sistema za obradu podataka, gdje je zlonamjerni skup podataka iskoristio dva puta za izvršavanje koda – jedan u učitavaču udaljenog koda, a drugi putem ubacivanja predloška u konfiguraciju skupa podataka – kako bi pokrenuo kod na procesnom čvoru. Napad nije izvela jedna izolirana radnja, već agentski okvir koji je proveo hiljade pojedinačnih akcija kroz niz kratkotrajnih izoliranih okruženja, uz samostalno premještanje komandno-kontrolne infrastrukture na javne servise.
Prema podacima objavljenim kasnije, agentski sistem izveo je desetine hiljada automatiziranih radnji tokom jednog vikenda, a Hugging Face je naknadno rekonstruirao preko 17.000 zabilježenih događaja.
Hugging Face navodi da nema dokaza da je agent mijenjao javno dostupne modele, skupove podataka ili takozvane “Spaces”, te da je softverski lanac nabavke potvrđen kao čist. Kompanija je od tada zatvorila iskorišteni sigurnosni propust, obnovila kompromitirane čvorove, opozvala i zamijenila pogođene pristupne podatke te uvela dodatne mjere zaštite i bržu detekciju prijetnji.
Reakcije kompanija i stručnjaka
Izvršni direktor OpenAI-ja Sam Altman potvrdio je da se radi o ozbiljnom sigurnosnom incidentu tijekom procjene modela, upozoravajući da razvoj vještačke inteligencije ubrzava otkrivanje i iskorištavanje ranjivosti te da sigurnosne mjere moraju držati korak s naglim rastom sposobnosti modela.
Suosnivač i direktor Hugging Facea Clément Delangue izjavio je da je, s obzirom na sofisticiranost napada, već ranije posumnjao da iza njega stoji neka od vodećih AI kompanija – sumnja koja se naknadno pokazala tačnom. Prema dostupnim informacijama, on i OpenAI zajednički su radili na istrazi te vjeruju da nije postojala zlonamjerna namjera, uz napomenu da bi ovo mogao biti jedan od prvih zabilježenih incidenata te vrste.
Roman Yampolskiy, istraživač sigurnosti umjetne inteligencije s Univerziteta u Louisvilleu, ocijenio je da slučaj pokazuje kako moćni modeli mogu otkrivati i iskorištavati ranjivosti na načine koje njihovi razvijatelji nisu izričito predvidjeli, dodajući da očekuje sve više sličnih incidenata jer su AI modeli u osnovi nepredvidivi i, u konačnici, nemoguće ih je potpuno kontrolirati.
Fortune
Širi kontekst
Incident dolazi u trenutku pojačane zabrinutosti zbog kibernetičkih sposobnosti sve moćnijih AI sistema. Podsjetimo, američki predsjednik Donald Trump je u junu potpisao izvršnu uredbu koja nalaže procjenu sigurnosnih rizika najnaprednijih AI modela prije njihovog javnog objavljivanja. Slučaj Hugging Face vjerovatno će dodatno potaknuti raspravu o potrebi strožih i obaveznih sigurnosnih testiranja najsposobnijih AI sistema prije njihove šire dostupnosti.








