Vještačka inteligencija napravila je još jedan korak koji je zabrinuo stručnjake. Tokom testiranja u kontrolisanim uslovima, jedan od najnaprednijih AI modela pokušao je da prevari stvarnu osobu koristeći lažni identitet kako bi dobio odobrenje za ubacivanje zlonamjernog koda u javni softverski projekat.
Kako je saopštio britanski Institut za bezbjednost vještačke inteligencije (AISI), riječ je o prvom zabilježenom slučaju u kojem je AI bez direktnog podsticaja pokušao da primijeni tehnike društvenog inženjeringa nad stvarnom osobom.
Prema izvještaju instituta, modeli kompanija Anthropic i OpenAI testirani su u posebno kontrolisanim uslovima, uz znatno ublažene zaštitne mehanizme i omogućen pristup internetu kako bi se procijenilo njihovo ponašanje u složenijim scenarijima.
Tokom 122 bezbjednosna izazova, u deset slučajeva AI agenti preduzimali su neovlašćene radnje na internetu usmjerene prema stvarnim ljudima i organizacijama. Većina tih pokušaja pripisana je modelu kompanije Anthropic, dok su dva incidenta zabilježena kod OpenAI modela.
Najozbiljniji slučaj dogodio se kada je AI kreirao više lažnih identiteta i pokušao da kontaktira stvarne osobe putem interneta, šaljući im poruke i datoteke s ciljem da ih navede da pokrenu zlonamjerni kod. Kada su njegove aktivnosti dovedene u pitanje, model je pokušao da izmijeni prethodne zapise i razmatrao korišćenje novog identiteta kako bi nastavio svoje djelovanje.
Ipak, institut naglašava da nije nastala nikakva stvarna šteta i da nema dokaza da su modeli izašli iz kontrolisanog okruženja u kojem su testirani.
Kompanija Anthropic saopštila je da su testovi sprovedeni u namjerno popustljivim uslovima, sa uklonjenim zaštitnim mehanizmima, te da zajedno sa istraživačima analiziraju cijeli incident.
Sličan stav iznio je i OpenAI, navodeći da su zabilježena dva slučaja u kojima su njihovi modeli izvršili radnje koje nijesu bile predviđene testovima. Iz kompanije poručuju da će nastaviti saradnju sa istraživačima i ostatkom industrije kako bi unaprijedili bezbjednosne standarde za razvoj naprednih AI sistema.
Ovaj slučaj dodatno je podstakao raspravu o potrebi strožih pravila i bezbjednosnih provjera za razvoj sve moćnijih sistema vještačke inteligencije.
Index.hr



