OpenAI je otkrio da su neki od njihovih najnaprednijih AI modela "izmakli kontroli" i hakovali jednu startap kompaniju nakon što su tokom bezbjednosnog testa izgubili kontrolu nad njima, piše BBC.
Kompanija je saopštila da je njihov AI agent – sistem vještačke inteligencije koji može samostalno djelovati nakon što dobije osnovna ljudska uputstva – testiran u kontrolisanom okruženju, ali je pronašao bezbjednosne ranjivosti i uspio da pobjegne iz tog okruženja.
Nakon toga, agenti su ciljali kompaniju Hugging Face, jednu od najvećih svjetskih platformi za dijeljenje AI modela, i uspjeli da pristupe dijelu njenih internih sistema.
OpenAI je naveo da je ovaj incident bio „bez presedana“ i da zajedno sa kompanijom Hugging Face sprovodi istragu. Direktor Hugging Face-a, Clement Delangue, napisao je na mreži X da je „nevjerovatno da se sve ovo dogodilo potpuno autonomno“.
„Istraga je u toku i podijelićemo dodatna saznanja o onome što bi mogao biti prvi incident ove vrste“, dodao je Delangue.
Đina Nef, direktorica Centra za tehnologiju i demokratiju Minderoo pri Univerzitetu u Kembridžu, izjavila je za BBC Radio 4 da su bezbjednosna testna okruženja, poznata kao „sandbox“ sistemi, namijenjena tome da se u njima bezbjedno ispituju sposobnosti AI modela.
„U ovom slučaju izgleda da OpenAI nije napravio dovoljno bezbjedan sandbox“, rekla je ona.
Umjesto da ostanu u tom okruženju, AI agenti su pokrenuli sajber napad na sam sandbox, pronašli ranjivost koja im je omogućila izlazak iz njega, a zatim su identifikovali Hugging Face kao vjerovatan izvor informacija koje su tražili u okviru testa i pokušali da dobiju pristup njihovim sistemima.
U prvom saopštenju o incidentu, objavljenom 16. jula, Hugging Face je naveo da još procjenjuje da li su podaci korisnika ili partnera bili ugroženi i da će obavijestiti sve pogođene ukoliko bude potrebno.
Kompanija je saopštila da su u međuvremenu otklonjene sve ranjivosti koje su iskorišćene tokom incidenta i da su pogođeni sistemi obnovljeni.
„Autonomni AI alati za izvođenje sajber napada više nijesu samo teorija. Odbrana internet platformi sada podrazumijeva da se podaci i AI modeli tretiraju kao ključna površina za napade, uz korišćenje vještačke inteligencije u odbrani kako bi se pratila brzina razvoja prijetnji. Nastavićemo da ulažemo u tu oblast i dijelimo iskustva koja steknemo”, naveli su iz kompanije.









