Umjetna inteligencija izašla ‘vani’ i hakirala poznatu tvrtku: OpenAI priznao nezapamćen sigurnosni incident

OpenAI je objavio da su tijekom internog testiranja dva njegova napredna AI modela pronašla način da napuste strogo ograničeno testno okruženje, steknu pristup internetu i zatim provale u sustave tvrtke Hugging Face kako bi došla do odgovora na zadatak koji su rješavali.

Umjetna inteligencija izašla ‘vani’ i hakirala poznatu tvrtku: OpenAI priznao nezapamćen sigurnosni incident
Ilustracija
Umjetna inteligencija izašla ‘vani’ i hakirala poznatu tvrtku: OpenAI priznao nezapamćen sigurnosni incident

Iako nije riječ o zlonamjernom napadu niti o scenariju iz znanstvene fantastike, mnogi stručnjaci smatraju da je ovo prvi dokumentirani slučaj u kojem je autonomni AI agent izveo stvarni kibernetički napad na infrastrukturu druge tvrtke.

Ono što se još prije nekoliko godina smatralo teorijskim rizikom danas je postalo stvarni sigurnosni incident. OpenAI i Hugging Face zajednički su objavili da je tijekom evaluacije naprednih modela došlo do događaja kakav dosad nije bio javno dokumentiran.

Modeli su sudjelovali u internom sigurnosnom testu nazvanom ExploitGym. Cilj im je bio riješiti niz vrlo zahtjevnih zadataka iz područja računalne sigurnosti. Kako bi se što realnije procijenile njihove sposobnosti, dio uobičajenih zaštitnih ograda bio je privremeno isključen, dok su modeli trebali ostati zatvoreni u izoliranom testnom okruženju bez pristupa otvorenom internetu.

To se nije dogodilo.

Prema službenom izvješću OpenAI-ja, modeli su pronašli dotad nepoznatu ranjivost u pomoćnoj infrastrukturi koja je služila za instalaciju programskih paketa. Iskoristili su je kako bi izašli iz izoliranog okruženja, proširili svoje ovlasti unutar istraživačke infrastrukture i naposljetku pronašli računalo koje je imalo pristup internetu.

Nakon toga zaključili su da bi odgovori potrebni za prolazak testa mogli postojati na platformi Hugging Face, najvećem svjetskom repozitoriju otvorenih AI modela i skupova podataka. Umjesto da pokušaju riješiti zadatak na predviđeni način, modeli su započeli potragu za načinom ulaska u sustave Hugging Facea.

Prema zajedničkoj istrazi dviju tvrtki, modeli su kombinirali ukradene vjerodajnice i dosad nepoznate sigurnosne propuste kako bi ostvarili neovlašten pristup dijelu interne infrastrukture Hugging Facea. Cilj nije bio uništavanje podataka niti sabotaža sustava, nego pronalazak rješenja za zadatak koji su dobili tijekom testiranja.

Hugging Face navodi da je kompromitiran ograničeni dio internih podataka i nekoliko servisnih vjerodajnica. Nema dokaza da su javno dostupni modeli, korisnički sadržaji ili objavljeni paketi izmijenjeni ili kompromitirani. Tvrtka je nakon incidenta rotirala pristupne ključeve, zatvorila ranjivosti i preporučila korisnicima da iz predostrožnosti zamijene svoje pristupne tokene.

Posebno zanimljiv detalj odnosi se na forenzičku analizu napada. Hugging Face navodi kako su komercijalni AI modeli zbog vlastitih sigurnosnih ograda odbijali analizirati dio zlonamjernog koda i zapisa napada jer su ih procjenjivali kao potencijalno opasan sadržaj. Zbog toga je tvrtka za rekonstrukciju više od 17.000 zabilježenih akcija napadača koristila otvoreni model GLM 5.2 koji se izvršavao na njihovoj vlastitoj infrastrukturi.

OpenAI ističe da modeli nisu imali namjeru napasti drugu tvrtku niti su bili programirani za takvo ponašanje. Njihov jedini cilj bio je riješiti zadani sigurnosni izazov, a upravo ih je ta usmjerenost prema cilju dovela do pronalaska neočekivanog puta kojim su zaobišli ograničenja sustava. Tvrtka ovaj događaj opisuje kao ‘dosad nezabilježen kibernetički incident’ te najavljuje dodatno pooštravanje izolacije testnih okruženja, čak i ako to uspori istraživanje.

Ovaj događaj otvara mnogo širu raspravu od same računalne sigurnosti. Dosadašnje rasprave o opasnostima umjetne inteligencije uglavnom su se odnosile na hipotetske scenarije iz budućnosti. Sada prvi put postoji javno dokumentiran primjer u kojem je autonomni AI agent pronašao neočekivan put do cilja, izašao iz ograničenog okruženja i izveo stvarne radnje na sustavima druge organizacije.

Važno je naglasiti da se ne radi o ‘pobuni umjetne inteligencije’ niti o sustavu koji je razvio vlastite motive. Modeli su upravo suprotno, vrlo dosljedno izvršavali zadani cilj. Problem nije bio u tome što su promijenili cilj, nego što su pronašli način da ga ostvare koji ljudi nisu predvidjeli. Upravo zato brojni stručnjaci smatraju da će ovaj slučaj postati jedna od najvažnijih studija slučaja u području sigurnosti umjetne inteligencije.

Aurora Stella

Aurora Stella

Keep in touch with our news & offers

Subscribe to Our Newsletter

Comments