Nauka i tehnologija

AI bezbjednosni incidenti: Metin model hakirao sistem tokom testiranja

AI bezbjednosni incidenti sve su češći u tehnološkoj industriji, a najnoviji primjer stiže iz kompanije Meta, čiji je model tokom testiranja dobio pristup internetu i hakirao tuđi sistem. Kompanija je potvrdila da je uzrok pogrešna konfiguracija sistema i da se incident istražuje.

Ovaj slučaj uslijedio je nakon niza sličnih incidenata u AI industriji, uključujući propuste kod modela kompanija OpenAI i Anthropic, što je povećalo zabrinutost zbog sajber bezbjednosti. Istraživači i vlade već pozivaju na strože bezbjednosne mjere i rigoroznije testiranje AI sistema.

Metin model probio sistem

Iz Mete je za BBC potvrđeno da se incident istražuje, a uzrok je, kako su naveli, pogrešna konfiguracija sistema. Dodali su da je riječ o problemu kakav su ranije prijavljivale i druge kompanije. Meta je navela da je bezbjednosna testiranja sprovela kompanija Irregular, specijalizovana za bezbjednost vještačke inteligencije, koja je ranije testirala i Anthropicov model nakon što je on dobio pristup sistemima tri druge kompanije.

Portparol kompanije Irregular izjavio je da je incident u Meti potpuno isti problem u testnom okruženju koji je Anthropic objavio prošle sedmice. Dodao je da Irregular trenutno priprema izvještaj o tome kako bezbjedno sprovoditi sajber-bezbjednosna testiranja koja uključuju AI agente. Meta je takođe najavila da će objaviti više informacija o incidentu kada budu poznate sve činjenice.

Slični propusti kod konkurencije

U protekle dvije sedmice i OpenAI i Anthropic prijavili su incidente u kojima su njihovi AI modeli tokom testiranja hakovali sisteme drugih organizacija. OpenAI, koji stoji iza ChatGPT-a, saopštio je da su njegovi AI agenti napali nekoliko javno dostupnih servisa, uključujući platformu za AI alate Hugging Face. Nakon toga, Anthropic je pokrenuo sopstvenu provjeru i otkrio da je njegov model Claude izveo slične napade na više kompanija, nakon što mu je zbog pogrešne konfiguracije omogućen pristup internetu.

Danijel Halm, globalni direktor za vještačku inteligenciju u marketinškoj kompaniji WPP, rekao je za BBC da takvi AI modeli nisu svjesni niti namjerno rade nešto zlonamjerno. Oni jednostavno osmišljavaju veoma sofisticirane strategije ili sajber napade kako bi ostvarili cilj koji im je zadat, objasnio je on u emisiji Today. Kada vještačkoj inteligenciji date cilj, ako ne predvidite sve načine na koje bi mogla da ga ostvari, ona će pronaći rješenje na koje niste ni pomislili.

Pojedini komentatori doveli su u pitanje tajming objavljivanja ovih incidenata, u trenutku kada se tehnološke kompanije žestoko nadmeću za dominaciju u razvoju vještačke inteligencije. OpenAI i Anthropic pripremaju velike izlaske na berzu, a procjenjuje se da bi vrijednost svake od tih kompanija mogla da dostigne oko bilion dolara, što je oko 740 milijardi funti.

Nalazi britanskog instituta

Britanski Institut za bezbjednost vještačke inteligencije (AISI) saopštio je ove sedmice da je tokom svojih testiranja utvrdio da su pojedini AI modeli pokušavali da izvedu sajber napade tako što su kreirali lažne profile stvarnih ljudi kako bi obmanuli korisnike. U najozbiljnijem slučaju, AISI navodi da je Anthropicov model Mythos AI pokušao da dobije pristup jednom servisu slanjem privatnih poruka preko lažnih naloga koji su oponašali stvarne osobe.

Iz Anthropica su odgovorili da testovi AISI-ja nisu reprezentativni ni za jedan od njihovih produkcionih modela, dok je OpenAI, čiji su modeli takođe bili testirani, saopštio da rezultati AISI-ja ne odražavaju način na koji se njihovi sistemi koriste u svakodnevnoj praksi.

Izvor
Srpskainfo

Komentariši

Vaša email adresa neće biti objavljivana. Neophodna polja su označena sa *

Back to top button