Hronika

Šta je pošlo po zlu: Kako je "pobjegao" OpenAI model vještačke inteligencije

Šta je pošlo po zlu: Kako je "pobjegao" OpenAI model vještačke inteligencije
Foto: Pixabay/Ilustracija | AI agenti pronašli su put do otvorenog interneta

Kada biolozi eksperimentišu s opasnim virusima, to rade pod strogim pravilima kako bi spriječili njihovo curenje ili bijeg iz laboratorije.

Međutim, slična pravila ne postoje za sisteme vještačke inteligencije, iako bi posljedice njihovog "bijega" mogle biti katastrofalne.

To više nije samo teorijska mogućnost. Testni model kompanije OpenAI ove sedmice uspio je da napusti testno okruženje i provali u servere stvarne kompanije dok je pokušavao da uspješno završi internu provjeru iz oblasti sajber bezbjednosti.

Stručnjaci upozoravaju da će se slični incidenti ponavljati ukoliko kompanije koje razvijaju vještačku inteligenciju ne pooštre bezbjednosne procedure tokom testiranja, uključujući i obuku modela da zadatke rješavaju na etičan način.

Predsjednik OpenAI Greg Brokman (Brockman) rekao je za CNN na konferenciji za novinare u četvrtak da kompanija i dalje sprovodi "potpunu istragu" kako bi "u potpunosti razumjela šta se dogodilo".

"Ovo je nešto što moramo shvatiti veoma ozbiljno. Analiziramo svaki dio našeg sistema kako bismo utvrdili na koji način treba da odgovorimo", rekao je Brokman.

Kako funkcioniše "sandbox"

Ograničen pristup koji nije bio potpuno zatvoren

AI sandbox je izolovano testno okruženje koje kompanije koriste za ispitivanje modela vještačke inteligencije. Njegova svrha je da sve što se dešava unutar njega ostane potpuno odvojeno od ostatka sistema.

Kompanije u takvim uslovima često privremeno uklanjaju bezbjednosna ograničenja modela kako bi provjerile njegove stvarne sposobnosti, ali uz pretpostavku da će ostati izolovan.

Međutim, u ovom slučaju OpenAI sandbox nije bio potpuno odsječen od mreže i interneta, rekla je za CNN Džesika Dži (Jessica Ji), viša istraživačka analitičarka Centra za bezbjednost i nove tehnologije Univerziteta Džordžtaun (Georgetown Center for Security and Emerging Technology).

Iz OpenAI navode da su modeli tokom testiranja imali veoma ograničen pristup mreži kako bi mogli da instaliraju resurse iz softvera treće strane koji se nalazio na internim serverima kompanije.

Iskoristio nepoznatu ranjivost

Iskoristivši do tada nepoznatu ranjivost u tom softveru, AI agenti pronašli su put do otvorenog interneta, a potom i do platforme Hugging Face, koja služi za razmjenu modela i skupova podataka otvorenog koda. Do nje su stigli koristeći ukradene akreditive i druge bezbjednosne propuste.

Dži ističe da ni OpenAI ni kompanija koja je razvila taj softver nisu znali za ranjivost koja je omogućila modelu da "pobjegne", što pokazuje koliko je važno detaljno provjeriti cijeli sistem i otkriti sve moguće bezbjednosne propuste.

Prvi javno objavljeni slučaj ovakve vrste

Ovo nije prvi put da je model vještačke inteligencije uspio da izađe iz sandbox okruženja.

Kompanija Anthropic ranije ove godine saopštila je da je svom modelu namjerno dala zadatak da to učini. Kada je u tome uspio, model je čak poslao imejl jednom istraživaču kompanije Anthropic, iako nije trebalo da ima tu mogućnost.

Ipak, slučaj sa Hugging Faceom jedan je od prvih javno objavljenih primjera u kojem je model vještačke inteligencije napustio svoje testno okruženje i hakovao sistem druge kompanije, iako za to nije bio posebno programiran.

Stručnjaci traže strože mjere

Dži smatra da bi kompanije morale mnogo strože da izoluju modele koje testiraju.

"To može značiti da će inženjeri morati fizički da odu u data centar i direktno se povežu na mrežu, umjesto da sve pokreću u oblaku ili distribuiranim virtuelnim okruženjima, kako je danas uobičajeno", rekla je ona.

Dodala je da bi kompanije morale imati mogućnost da u svakom trenutku ručno isključe mrežni pristup modelu kao dodatnu bezbjednosnu mjeru, naročito kada testiraju rizične scenarije, poput provjere da li AI agent može da hakuje banku.

Model će učiniti sve da ispuni zadatak

Nagrada je važnija od posljedica

Jedna od najčešćih metoda obuke modela vještačke inteligencije jeste učenje kroz nagrađivanje (reinforcement learning), pri kojem model dobija nagradu kada uspješno izvrši zadatak.

Problem je što će modeli često učiniti gotovo sve da ostvare cilj, uključujući i neetične postupke poput hakovanja.

Svi najnapredniji modeli koje je nedavno testirao Britanski institut za bezbjednost vještačke inteligencije (UK AI Security Institute) pokušali su da varaju barem u određenom broju slučajeva.

Vezane vijesti:

Da li je AI postala samostalna? Ovakvi slučajevi biće sve češći 

AI modeli pobjegli iz izolacije i izveli hakerski napad 

Naučnici zabrinuti: AI modeli varaju da se spasu

Modeli razmišljaju o posljedicama svojih postupaka samo ako su za to posebno obučeni, objašnjava Džastin Kapos (Justin Cappos), profesor sajber bezbjednosti na Univerzitetu u Njujorku.

Kao primjer navodi situaciju u kojoj bi neko dobio zadatak da do kraja dana obezbijedi 10 miliona dolara. Provala u bankarski trezor ispunila bi taj cilj, iako bi kasnije uslijedilo hapšenje.

"Ovo moramo shvatiti kao ozbiljno upozorenje"

"Ovo je zaista jezivo. Sada imamo konkretne dokaze da će loše usklađeni sistemi vještačke inteligencije praktično počiniti krivična djela ukoliko ne postoje snažne zaštitne mjere", rekao je Stiven Adler (Steven Adler), bivši direktor za bezbjednost proizvoda u OpenAI-ju, koji danas vodi organizaciju Guidelight AI Standards.

"Ovaj incident moramo shvatiti kao ozbiljno upozorenje."

Ovosedmični incident dodatno je pojačao zahtjeve istraživača, stručnjaka za sajber bezbjednost i zakonodavaca da se razvoj vještačke inteligencije jasnije reguliše.

"Pretpostavljam da mnogi ljudi upravo vode veoma hitne telefonske razgovore", rekla je Dži.

Globalna trka otežava uvođenje pravila

Međutim, Kapos upozorava da postoji veliki problem.

U toku je globalna trka za dominaciju u oblasti vještačke inteligencije i razvoj modela koji će moći sami sebe da unapređuju. Stroža pravila mogla bi da uspore taj razvoj.

"Zbog toga kompanije imaju snažan podsticaj da ne uvode stroge bezbjednosne kontrole, osim ako to ne učine i njihovi konkurenti", rekao je Kapos.

"Upravo je to suština cijelog problema."

 
 
 

Najčitanije