OpenAI obustavlja dio rada na AI modelu Astra zbog bezbjednosnih rizika

· 18:14 · admin · 1 pregleda · 0 komentara
4 min citanja

Utvrđeno da agent može samostalno da pronađe i iskoristi ranjivosti, kao i da izvodi sajber napad

OpenAI će obustaviti dio rada na jednom modelu vještačke inteligencije zbog bezbjednosnih rizika, saopštila je kompanija, nakon niza incidenata u kojima su AI agenti uspjeli da izađu iz kontrolisanih okruženja.

Kompanija je testirala agenta Astra i utvrdila "značajan napredak u autonomnom programiranju i sajber bezbjednosti", čime je dostignut "kritični" prag na kojem model može da pronađe i iskoristi ranjivosti bez ljudske intervencije, ili da osmisli i sprovede sajber napade kada mu se zada samo "opšti željeni cilj", piše Gardijan.

OpenAI je saopštio da taj model nije bio uključen u incident tokom kojeg je jedan od njegovih AI agenata izmakao kontroli tokom testiranja, pristupio otvorenom internetu i hakovao startap Hugging Face. Kompanija je otkrila i druge slučajeve u kojima su autonomni agenti uspjeli da izađu iz kontrolisanog okruženja, objavio je Rojters u julu.

Izvještaji su pojačali zabrinutost zbog napretka AI modela i sposobnosti ljudi da ih kontrolišu. Ipak, kritičari industrije vještačke inteligencije upozorili su da bi ovakva saopštenja OpenAI-ja i njegovih konkurenata, kompanija Anthropic i Meta, mogla biti osmišljena tako da stvore dodatnu pompu oko moći te tehnologije i time podstaknu veće interesovanje investitora.

Kako bi spriječio potencijalno nekontrolisano ponašanje AI agenata, OpenAI "uvodi strože bezbjednosne kontrole za modele sa većim sposobnostima i aktivnosti povezane sa njima, uključujući izolovana okruženja za testiranje, ograničen pristup mreži i alatima", navedeno je u objavi kompanije.

Biće uvedene i "pojačane mjere zaštite težina modela i enkripcija, kao i dodatne mogućnosti nadzora i otkrivanja prijetnji".

Kompanija će obustaviti interne aktivnosti koje uključuju Astru, a koje ne ispunjavaju nove zahtjeve.

"Posvećeni smo saradnji sa vladama, institutima za bezbjednost i civilnim društvom kako bismo osigurali da napredne sposobnosti modela poput Astre, kao i onih koji će uslijediti, budu primjenjivane odgovorno i široko, za dobrobit cijelog čovječanstva", saopštila je kompanija.

Meta je ove sedmice takođe objavila da je jedan od njenih modela hakovao drugu kompaniju tokom testiranja sajber bezbjednosti. Britanski Institut za bezbjednost vještačke inteligencije (AISI) objavio je 4. avgusta da su agenti koje pokreću modeli OpenAI-ja i Anthropica slali ciljane mejlove programerima softvera u pokušaju da prođu sajber izazov.

"Ti pokušaji nijesu bili uspješni i naše istrage nijesu pronašle dokaze da je nastala bilo kakva šteta u stvarnom svijetu. Ali ovo je prvi put da smo vidjeli da se rizici povezani sa autonomijom i obmanom ovako jasno ispoljavaju u stvarnom svijetu, bez konkretnog podsticaja“, saopštio je institut u objavi na svom blogu.

Organizacija je naglasila da slanje štetnog softvera od strane modela nije predstavljalo slučaj u kojem je "model pobjegao iz bezbjednog testnog okruženja", već da je grupa namjerno omogućila pristup internetu kako bi "što bolje procijenila maksimalne sposobnosti modela".

Ipak, takvo "ponašanje je bilo moguće, trajalo je određeno vrijeme i bilo je novo; već to samo po sebi zahtijeva pažnju", saopštio je AISI.

Izvještaji su objavljeni u trenutku kada je administracija Donalda Trampa završavala okvir za testiranje bezbjednosnih i sajber rizika AI modela.

OpenAI i Anthropic, koji se suočavaju sa sve većom konkurencijom iz Kine i drugih tehnoloških kompanija, tvrde da modeli otvorenog koda – odnosno oni koji svakome omogućavaju da vidi i mijenja izvorni programski kod – predstavljaju bezbjednosni rizik i zalažu se za dodatnu federalnu regulativu za takve modele.

Ostavite komentar

Vasa email adresa nece biti objavljena. Obavezna polja su oznacena *