Kineska kompanija za razvoj veštačke inteligencije Munšot pokrenula je internu istragu pošto su istraživači uspeli da navedu dva njena popularna AI modela, Kimi K2.6 i K3 Swarm, da daju uputstva za izradu biološkog oružja i izvođenje atentata.
Kompanija Majngard, koja se bavi testiranjem bezbednosti AI sistema, saopštila je da je u julu otkrila da oba modela mogu da zaobiđu bezbednosna ograničenja.
Do otkrića je došlo tokom takozvanog „jailbreakinga“ (džejlbrejking) postupka u kojem istraživači koriste niz složenih instrukcija kako bi proverili da li AI alati mogu da zaobiđu ugrađene zaštitne mehanizme.
Iz Majndgarda kažu da je upravo ta zaštita trebalo da spreči Kimi da daje odgovore o ovako opasnim temama.
Iz Mušota su za BBC poručili da pozdravljaju povratne informacije nezavisnih stručnjaka i trećih strana, ističući da su one „ključni stub u izgradnji boljih i bezbednijih AI sistema“.
Iz kompanija su za BBC naveli i da su sa Majndgardom u kontaktu povodom rezultata njihovog istraživanja.
Piter Garagan, osnivač Majndgarda, rekao je u BBC emisiji Tech Life da su nalazi o modelima Kimi K2.6 i K3 Swarm zabrinjavajući.
„Kada džejlbrejk uspe, model će razgovarati o praktično bilo kojoj temi. Čak će sam nuditi preporuke o drugim temama koje su takođe zlonamerne, pri čemu će biti inventivan i kreativan“, rekao je Garagan.
Džejlbrejk napadi predstavljaju drugačiju vrstu rizika od one koju smo videli u nizu nedavnih, veoma zapaženih incidenata povezanih sa veštačkom inteligencijom.
U tim slučajevima, autonomni AI alati poznati kao agenti, koje su razvile američke kompanije poput OpenAI-ja, Mete i Antropika, uspeli su da hakuju pojedine onlajn servise.
Iako su džejlbrejkovi složeni procesi koji zahtevaju mnogo vremena, upornosti i tehničkog znanja, pojedini stručnjaci strahuju da bi hakeri i drugi zlonamerni akteri mogli da pokušaju da ih iskoriste za nanošenje štete.
Kompanija Antropik nedavno je saopštila da je identifikovala i sprečila pokušaje korišćenja jednog od njenih AI modela za „zlonamerne aktivnosti“ koje bi mogle da doprinesu razvoju biološkog oružja.
Alat za pokretanje sajber-napada
U Majndgardu nisu utvrdili da li bi odgovori koje je Kimi pružao na sporna pitanja mogli da se primene u praksi.
Ipak, iz kompanije kažu da su zaštitni mehanizmi morali da spreče modele da uopšte ulaze u razgovor sa korisnicima o takvim temama.
Iz kompanije navode i da bi „džejlbrejkovani“ Kimi K2.6 mogao hakerima da omogući pokretanje koda i povezivanje sa internetom, čime bi potencijalno mogao da postane polazna tačka za sajber-napade.
Garagan je branio odluku Majndgarda da javno govori o načinu na koji je kompanija uspela da zaobiđe zaštitne mehanizme Munšotovih sistema.
Istakao je da je kompanija o tome prethodno obavestila Munšot i da nije otkrila ključne detalje o tome kako je uspela da navede njihove modele da ignorišu zaštitne mere.
Majndgard je 27. jula mejlom obavestio Munšot o otkrivenom propustu, a nedelju dana kasnije ponovo im se obratio.
Kompanija je potom 12. septembra objavila tekst na blogu o ovom problemu.
Međutim, iz Majndgarda tvrde da su im se iz Munšota obratili tek nedavno, pošto BBC zatražio komentar.
U delu mejla koji je Munšot poslao Majndgardu tražeći dodatne informacije, a koji je kompanija ustupila BBC-ju, navodi se da je njihov model tokom internih testiranja generalno pokazivao „visoku stopu odbijanja ovakvih zahteva“.
Kako sprečiti napade
Ova saznanja dolaze u trenutku kada se u svetu veštačke inteligencije i dalje vodi debata o tome da li su bezbedniji zatvoreni modeli, poput Četdžipitija i Kloda ili modeli otvorenog koda.
Kimi je model sa otvorenim parametrima, što znači da ga je, barem u teoriji, moguće preuzeti i pokrenuti na sopstvenoj računarskoj infrastrukturi.
Profesor Alan Vudvord sa univerziteta u Sariju rekao je za BBC da postoji rizik da modeli otvorenog koda dospeju u pogrešne ruke, ali i da mogu biti korisni za sajber-odbranu.
Kao primer naveo je kompaniju Huging Fejs, koja je koristila kineski model otvorenog koda kako bi analizirala jedan hakerski napad.
Kasnije je utvrđeno da su napad izveli AI agenti kompanije OpenAI.
Vudvord smatra da međunarodni propisi verovatno neće moći da prate brzinu razvoja veštačke inteligencije.
„Bile su nam potrebne decenije da se dogovorimo čak i o formatu telefonskih brojeva“, rekao je.
Poput osnivača Majndgarda Pitera Garagana, Vudvord smatra da bi veću pažnju trebalo posvetiti otkrivanju i procesuiranju ljudi koji zloupotrebljavaju veštačku inteligenciju.
BBC na srpskom je od sada i na TikToku, pratite nas OVDE.
Pratite nas na Fejsbuku, Tviteru, Instagramu, Jutjubu, Vajberu. Ako imate predlog teme za nas, javite se na bbcnasrpskom@bbc.co.uk
- Ljudi koji veruju da je veštačka inteligencija Antihrist
- AI hakovala sajtove državnih institucija u Americi
- Uzbuna: Veštačka inteligencija hakovala sajt australijske vlade
- Može li veštačka inteligencija zaista da istrebi čovečanstvo i kako
Pogledajte još:
Preuzmi aplikaciju i prati vijesti
PRATITE NAS NA