Googleov model umjetne inteligencije Gemini samostalno je pristupio internetu i izvršio hakerske napade na druge kompanije. To se dogodilo tokom testiranja njegovih kibernetičkih sposobnosti.
Incident se desio u maju ove godine, tokom sigurnosnog testiranja koje je sprovela nezavisna evaluacijska firma Irregular.
Heather Adkins, potpredsjednica za sigurnosni inženjering u Googleu, objasnila je da je Gemini pronašao javno dostupne informacije na internetu. Model je potom pogodio pristupne podatke i uspio ući na tri web stranice za koje je smatrao da su dio testiranja. Adkins je naglasila da su sve pogođene strane obaviještene i da se radi na izmjenama u procesu testiranja. Dodala je da ovi događaji ističu važnost odgovornog obučavanja moćnih AI modela, te da je Gemini u sva tri slučaja sam prekinuo hakerske aktivnosti.
Prema medijskim izvještajima, u jednom od incidenata Gemini je sistematski pogađao lozinke dok nije ostvario pristup zaštićenom sistemu. U preostala dva slučaja, model je otkrio akreditive u javno dostupnim repozitorijima, što mu je omogućilo ulazak u zaštićene sisteme.
Predstavnik kompanije Irregular potvrdio je da su slični problemi zabilježeni i u drugim AI laboratorijama. Sve relevantne kompanije su o tome obaviještene krajem jula. Iz Irregulara poručuju da su svi uočeni propusti s njihove strane već otklonjeni.
Slične incidente, u saradnji sa Irregularom, prijavile su i kompanije Meta, Anthropic i OpenAI. Meta je u augustu istakla da njihov incident nije podrazumijevao izlazak iz izolovanog okruženja niti sofisticirani cyber napad. Irregular trenutno aktivno radi na definisanju najboljih praksi za sigurno provođenje procjena sigurnosti AI sistema.
Ova situacija je pokrenula ozbiljna pitanja o potrebnim zaštitnim mehanizmima. Oni su ključni s obzirom na to da AI agenti dobijaju sve veću autonomiju i direktan pristup internetu i računarskim sistemima.