Studija o AI sigurnosti: Tri od pet modela pala na testovima vezanim za terorizam
Tri od pet modela vještačke inteligencije nisu prošla sigurnosne testove vezane za terorizam, pokazala je studija britanske organizacije Tech Against Terrorism, o čemu je izvijestio CBC News, a prenosi N1 BiH.

Prema pisanju N1 BiH, koje se poziva na izvještaj CBC News-a, modeli vještačke inteligencije kojima su uklonjene sigurnosne zaštite dosljedno su pružali potencijalno opasne informacije.
Studiju je provela neprofitna organizacija "Tech Against Terrorism" sa sjedištem u Velikoj Britaniji, koja je testirala više od 130 AI modela pomoću stotina upita sličnih onima koje bi mogao postaviti terorist koji planira napad. Modeli modificirani procesom poznatim kao "abliteracija", odnosno uklanjanje sigurnosnih zaštita, pali su na svakom testu.
Llama 3.1 8B, model kompanije Meta, prije modifikacije postigao je 97 od 100 bodova na sigurnosnoj skali organizacije, a nakon nje svega tri boda. Modificirana verzija davala je detaljne odgovore o napadima, finansiranju terorizma i radikalizaciji, dok je originalna odbijala takve upite.
"Razumljivo je da postoji zabrinutost zbog gubitka kontrole i egzistencijalnog rizika koji nosi AI", izjavio je Adam Hadley, osnivač i izvršni direktor organizacije. Po njegovim riječima, mnogi otvoreni modeli su već "provaljeni" – samo to još niko nije primijetio.
Organizacija je krajem prošlog mjeseca pronašla više od 29.000 repozitorija na platformi Hugging Face koji nude necenzurisane ili nezaštićene AI modele. Iz Hugging Facea su odgovorili da redovno moderiraju sadržaj koji krši njihova pravila, ali su upozorili da bi neke preporuke iz izvještaja mogle ugroziti otvorena istraživanja. Iz Mete su istakli da njihovi modeli prolaze sigurnosne procjene i da njihova pravila zabranjuju štetnu ili nezakonitu upotrebu.
Izvještaj ipak nije pronašao dokaze da terorističke ili ekstremističke grupe koriste testirane modele, osim jednog ekstremističkog chatbota koji su identifikovali istraživači. "Tech Against Terrorism" preporučuje uvođenje nezavisnih sigurnosnih mjerila, jaču zaštitu od uklanjanja sigurnosnih mehanizama i ograničenja u distribuciji modificiranih modela.
Povezane vijesti

OpenAI otpustio tri istraživača za sigurnost nakon spora o rizicima umjetne inteligencije

Cyber sigurnost mora biti prioritet: U Sarajevu konferencija o AI i digitalnim prijetnjama

Profesor sakrio riječ 'Madagaskar' u zadatak i otkrio ko koristi AI: Palo 32 od 35 studenata
