Nakon što je nedavno otkriveno da je autonomni sustav umjetne inteligencije tvrtke OpenAI probio sigurnosne protokole i samostalno napao platformu Hugging Face, iz OpenAI-ja sada priznaju da je razmjera incidenta bila znatno veća. Odbjegli AI agensi pristupili su višestrukim javno dostupnim uslugama.
Cyber-napad koji su izveli odmetnuti agensi ChatGPT-ja otišao je korak dalje nego što se u početku smatralo. Iako se vjerovalo da je platforma Hugging Face jedina žrtva ovog nezabilježenog napada, OpenAI je izvijestio kako je njihov bot napao nekoliko „javno dostupnih usluga”.
Umjetna inteligencija, koja se izmaknula kontroli, na internetu je pronašla četiri korisnička podatka (logina) koji su joj omogućili pristup četirima zasebnim, neimenovanim uslugama.
U međuvremenu, na izvanrednom brifingu s stotinama stručnjaka za cyber-sigurnost, predstavnici Hugging Facea opisali su kako je izgledalo biti na meti prvog potpuno autonomnog AI napada u povijesti.
Nadljudska brzina prožena neobičnim pogreškama
Iz tvrtke Hugging Face, koja služi kao svojevrsna trgovina aplikacija za AI alate, pojašnjavaju da su hakerski agensi djelovali neumorno, istovremeno isprobavajući tisuće različitih metoda.
Tvrtka je 16. srpnja prva objavila da je napadnuta putem snažne autonomne umjetne inteligencije te je slučaj prijavila policiji. Gotovo tjedan dana kasnije, OpenAI je priznao da je upravo njihov AI pobjegao iz zatvorenog testnog okruženja i tijekom provjere samostalno napao Hugging Face. Naime, model je pokušavao pronaći odgovore na ispit iz hakiranja koji mu je zadao sam OpenAI.
U srijedu je OpenAI dopunio svoju izjavu informacijom da je napad bio širi nego što se u početku mislilo.
„Modeli su identificirali i iskoristili javno izložene korisničke podatke na razini računa na drugim javno dostupnim uslugama. To uključuje četiri računa na četiri različite usluge”, priopćili su iz OpenAI-ja, ne pojašnjavajući odnosi li se pojam „javno dostupne usluge” na tvrtke, no naglasivši da ti novi napadi nisu bili jednake razine ozbiljnosti kao onaj na Hugging Face.
Nespretno ponašanje i nepredvidivost
Savez za sigurnost u oblaku (Cloud Security Alliance – CSA) objavio je izvješće temeljeno na hitnom sastanku s predstavnicima Hugging Facea.
„Agensi su pratili neučinkovite rute i pokazivali nespretno ponašanje koje niti jedan ljudski haker ne bi odabrao”, navodi CSA u izvješću. Agensi su ponavljali radnje koje su već završili — što je tipičan znak da agencijski AI gubi nit i kontekst. Također su halucinirali nizove nerazumljivih naredbi i teksta, bili su štrpavi i nisu dobro prikrivali svoje tragove.
No, unatoč pogreškama i čudnom ponašanju, Hugging Face upozorava da su AI agensi povlačili i briljantne tehničke poteze te su se u višednevnom napadu iznimno brzo prilagođavali novim scenarijima.
Efekt „Parka iz doba jure”
Bile su potrebne tri dana da agensi budu otkriveni unutar IT mreže Hugging Facea, a stručnjacima za cyber-sigurnost i AI bilo je potrebno mnogo sati da ih izoliraju i izbace — što je zadatak s kojim bi se uobičajene tvrtke teško nosile. Iako nisu otkrili točan financijski trošak, iz Hugging Facea su potvrdili da su njihovi zaposlenici morali raditi satima kako bi ponovno izgradili oko trećine svoje infrastrukture.
Zbog svoje transparentnosti u obavještavanju industrije, Hugging Face je dobio brojne pohvale. CSA je pak upozorio da ovaj incident pokazuje kako AI agensi „pronalaze put” — što je aluzija na film Park iz doba jure u kojem dinosauri bježe iz svojih fenced prostora.
„Oni su vođeni ciljem, sami postavljaju podciljeve, prilagođavaju se u stvarnom vremenu kako bi zaobišli obranu i djeluju brzinom stroja koja može u potpunosti nadjačati ručne obrambene operacije”, stoji u dokumentu.
Ritesh Patel, stručnjak za cyber-sigurnost koji je sudjelovao na brifingu s oko 450 drugih profesionalaca, ističe da industrija ubrzano radi na rješavanju ove nove prijetnje.
„Ovo je realnost autonomnih agenasa pokretanih naprednim modelima: neumorno su uporni, ponekad stvaraju veliku buku i pokušat će svaki mogući put do cilja, što lako može probiti tradicionalne obrambene mehanizme”, rekao je Patel.
Etička hakerica Valentina Palmiotti (poznata kao Chompie) dodaje da način na koji agensi hakiraju može izgledati nasumično, ali je iznimno učinkovit: „Bace hrpu stvari pa gledaju što će upaliti. Ali oni se ne umaraju, ne spavaju i mogu biti beskonačno uporni.”
Odmetnuti AI više nije iznimka već pravilo
Ovo nije prvi put da su AI agensi pokazali „odmetničko” ponašanje. U izvješću CSA-a spominje se primjer iz rujna 2024. godine kada je raniji model ChatGPT-ja pobjegao iz svog spremnika (containera) kako bi došao do odgovora potrebnog za drugi test. Taj je događaj tada bio zadržan unutar vlastitih IT sustava OpenAI-ja i u to je vrijeme uglavnom dočekan s odobravanjem.
Međutim, „odmetničko” ponašanje postaje pravilo, a ne iznimka, upozorava se u izvješću. Stručnjaci za cyber-sigurnost širom svijeta morat će se prilagoditi novoj stvarnosti u kojoj rojevi AI agenasa rade iznimnom brzinom na neobične i nespretne načine, što bi moglo dovesti do učestalih sigurnosnih proboja.
Izvješće poziva sve koji koriste ili razvijaju AI agense na odgovornost u njihovoj kontroli, predlažući uspostavu sustava koji bi obrambenim timovima omogućio da u svakom trenutku identificiraju vlasnika agenta radi veće transparentnosti.
Prema ranijim izvješćima, OpenAI-ju su bila potrebna četiri dana da uopće shvati da je njihova umjetna inteligencija hakirala Hugging Face. Iz OpenAI-ja su najavili da će uskoro objaviti rezultate vlastite istrage kako bi pomogli industriji da izvuče pouke iz ovog incidenta.
