Ti su incidenti pokrenuli raspravu o sigurnosnim mehanizmima koji postaju nužni dok AI agenti stječu sve veću samostalnost te mogućnost pristupa internetu i računalnim sustavima.
Googleov model umjetne inteligencije Gemini tijekom provjere svojih vještina na području kibernetičke sigurnosti spojio se na internet i provalio u druge kompanije, čime je zabilježen prvi poznati primjer da je Googleov AI sustav takvo što izveo bez ljudske intervencije.
Do hakiranja je došlo u svibnju, u sklopu kibernetičkog sigurnosnog ispitivanja koje je vodila samostalna tvrtka Irregular, specijalizirana za ocjenjivanje kibernetičke sigurnosti, kako piše Večernji.ba.
U okviru uobičajenog testiranja Gemini je na mreži otkrio javno dostupne podatke te je pogodio pristupne vjerodajnice kako bi ušao na tri internetske stranice za koje je pretpostavljao da su dio testiranja, izjavila je u priopćenju Heather Adkins, Googleova potpredsjednica za sigurnosno inženjerstvo.
„Osigurali smo da tri pogođena subjekta budu obaviještena te smo surađivali s našim partnerom za testiranje na promjenama koje su sada uvedene u njihove postupke testiranja“, kazala je Adkins. „Ovi događaji naglašavaju važnost osposobljavanja moćnih AI modela da djeluju odgovorno“, nadodala je.
Predstavnik Irregulara istaknuo je kako je taj incident vezan uz isti problem koji je pogodio i ostale AI laboratorije te da su svi mjerodavni laboratoriji o tome bili obaviješteni potkraj srpnja. „Svi poznati problemi na našoj strani otklonjeni su i riješeni prije nekoliko tjedana“, izjavio je.
O sličnim događajima povezanima s Irregularom ranije su izvijestili Meta, Anthropic i OpenAI. Meta je u kolovozu objavila kako incident nije obuhvaćao bijeg iz izoliranog testnog okruženja (sandbox escape) ni napredni kibernetički napad, a Irregular je priopćio da razvija najbolje prakse za sigurno izvođenje kibernetičkih testiranja AI sustava.
Ti su događaji potaknuli pitanja o zaštitnim mehanizmima koji su neophodni dok AI agenti dobivaju sve više autonomije te pristup internetu i računalnim sustavima.
U jednome od tih slučajeva Gemini je pogađao lozinke dok nije došao do pristupa zaštićenom sustavu. U preostala dva primjera model je u javno dostupnom repozitoriju pronašao pristupne podatke, čime je stekao pristup zaštićenim sustavima, izvijestio je Wall Street Journal, koji je o događaju prvi pisao u petak.
Adkins je navela kako je model u svim trima slučajevima obustavio hakiranje.
