Sci/Tech
  • Portal Analitika/
  • Sci/Tech /
  • Vještačka inteligencija "izmakla kontroli": OpenAI tvrdi da je njihov AI hakovao startap kompaniju

Tokom bezbjedonosnog testa

Vještačka inteligencija "izmakla kontroli": OpenAI tvrdi da je njihov AI hakovao startap kompaniju

U prvom saopštenju o incidentu Hugging Face je naveo da još procjenjuje da li su podaci korisnika ili partnera bili ugroženi i da će obavijestiti sve pogođene ukoliko bude potrebno

Vještačka inteligencija "izmakla kontroli": OpenAI tvrdi da je njihov AI hakovao startap kompaniju Foto: Unsplash
Portal AnalitikaIzvor

OpenAI je otkrio da su neki od njihovih najnaprednijih AI modela "izmakli kontroli" i hakovali jednu startap kompaniju nakon što su tokom bezbjednosnog testa izgubili kontrolu nad njima, piše BBC.

Kompanija je saopštila da je njihov AI agent – sistem vještačke inteligencije koji može samostalno djelovati nakon što dobije osnovna ljudska uputstva – testiran u kontrolisanom okruženju, ali je pronašao bezbjednosne ranjivosti i uspio da pobjegne iz tog okruženja.

Nakon toga, agenti su ciljali kompaniju Hugging Face, jednu od najvećih svjetskih platformi za dijeljenje AI modela, i uspjeli da pristupe dijelu njenih internih sistema.

OpenAI je naveo da je ovaj incident bio „bez presedana“ i da zajedno sa kompanijom Hugging Face sprovodi istragu. Direktor Hugging Face-a, Clement Delangue, napisao je na mreži X da je „nevjerovatno da se sve ovo dogodilo potpuno autonomno“.

„Istraga je u toku i podijelićemo dodatna saznanja o onome što bi mogao biti prvi incident ove vrste“, dodao je Delangue.

Đina Nef, direktorica Centra za tehnologiju i demokratiju Minderoo pri Univerzitetu u Kembridžu, izjavila je za BBC Radio 4 da su bezbjednosna testna okruženja, poznata kao „sandbox“ sistemi, namijenjena tome da se u njima bezbjedno ispituju sposobnosti AI modela.

„U ovom slučaju izgleda da OpenAI nije napravio dovoljno bezbjedan sandbox“, rekla je ona.

Umjesto da ostanu u tom okruženju, AI agenti su pokrenuli sajber napad na sam sandbox, pronašli ranjivost koja im je omogućila izlazak iz njega, a zatim su identifikovali Hugging Face kao vjerovatan izvor informacija koje su tražili u okviru testa i pokušali da dobiju pristup njihovim sistemima.

U prvom saopštenju o incidentu, objavljenom 16. jula, Hugging Face je naveo da još procjenjuje da li su podaci korisnika ili partnera bili ugroženi i da će obavijestiti sve pogođene ukoliko bude potrebno.

Kompanija je saopštila da su u međuvremenu otklonjene sve ranjivosti koje su iskorišćene tokom incidenta i da su pogođeni sistemi obnovljeni.

„Autonomni AI alati za izvođenje sajber napada više nijesu samo teorija. Odbrana internet platformi sada podrazumijeva da se podaci i AI modeli tretiraju kao ključna površina za napade, uz korišćenje vještačke inteligencije u odbrani kako bi se pratila brzina razvoja prijetnji. Nastavićemo da ulažemo u tu oblast i dijelimo iskustva koja steknemo”, naveli su iz kompanije.

Portal Analitika