Googleov Gemini tijekom testiranja samostalno pokušao provocirati tri kompanije

Googleov Gemini tijekom testiranja samostalno pokušao provocirati tri kompanije

Tijekom neovisnog testiranja sigurnosti Gemini je pronašao javno dostupne podatke i pokušao prodreti u zaštićene sustave triju tvrtki, ali je u sva tri slučaja sam prekinuo napad.

Tijekom testiranja koje je provela neovisna evaluacijska firma Irregular, Googleov je umjetnički inteligencijski model Gemini pristupio internetu i samostalno pokušao prodreti u sustave triju kompanija. Riječ je o prvom javno poznatom slučaju u kojem Googleov AI sustav izveo takvu aktivnost. Incident se dogodio u svibnju. Gemini je prema riječima Heather Adkins, potpredsjednice Googlea za sigurnosno inženjerstvo, na internetu pronašao javno dostupne informacije i pokušao pogoditi podatke kako bi stupio u kontakt s tri internetske stranice koje je procijenio da su dio testnog okvira. – Osigurali smo da sve tri pogođene strane budu obaviještene i surađivali smo s našim partnerom na prilagodbi procesa testiranja. Ovi događaji naglašavaju važnost obuke moćnih AI modela kako bi djelovali odgovorno – izjavila je Adkins. Dodala je da je Gemini u sva tri slučaja sam prekinuo pokušaj prodiranja. Kako je prvi izvijestio Wall Street Journal, u jednom slučaju model je nastavio pogoditi lozinke sve dok mu ne priđe zaštićeni sustav. U druga dva slučaja model je pronašao vjerodajnice u javno dostupnom repozitoriju i kasnije ih iskoristio za ulazak u zaštićene sustave. Glasnogovornik tvrtke Irregular potvrdio je da se isti problem pojavio i tijekom testiranja drugih AI laboratorija, a sve zainteresirane kompanije obaviještene su krajem srpnja. Iz Irregulara navode da su svi uočeni propusti otklonjeni prije nekoliko tjedana. Slične incidente povezane s testiranjima Irregulara ranije su priopćile i Meta, Anthropic te OpenAI. Iz Mete su u kolovozu naglasili da njihov slučaj nije uključivao bijeg iz izoliranog okruženja niti sofisticiran kibernetički napad. Irregular u međuvremenu radi na definiranu najboljih praksi za sigurno provodnog sigurnosnih procjena AI sustava. Novo otvorena pitanja tiču se zaštitnih mehanizama koji su potrebni kada AI agenti dobivaju sve veću autonomiju, izravan pristup internetu i računalnim sustavima.