Meta je potvrdila da je jedan od njenih AI modela tokom testiranja iskoristio ranjivost i pristupio sistemu druge kompanije
Meta i druge firme sprovode dodatne bezbednosne provere kako bi sprečile ovakve incidente u budućnosti
Kompanija Meta potvrdila je da je jedan od njenih modela veštačke inteligencije tokom bezbednosnog testiranja iskoristio ranjivost i pristupio sistemu druge kompanije. Incident je ponovo otvorio pitanje koliko je teško zadržati napredne AI modele unutar kontrolisanog digitalnog okruženja.
Do incidenta je došlo nakon što je kompanija Irregular, koja za Metu sprovodi bezbednosne provere, pogrešnom konfiguracijom modelu nenamerno omogućila pristup otvorenom internetu.
Meta je saopštila da istražuje slučaj u kojem je model „iskoristio bezbednosnu ranjivost u usluzi treće strane“, na način sličan incidentima koji su prethodno zabeleženi u drugim tehnološkim kompanijama, prenosi Reuters.
AI model menjao delove tuđeg sistema
Prema navodima portala The Information, reč je o modelu Muse Spark 1.1, koji je pristupio sistemu za sada neimenovane kompanije i izmenio deo njenog internog digitalnog okruženja.
Ipak, iz kompanije Irregular tvrde da se nije dogodio izlazak iz zaštićenog testnog okruženja niti posebno složen sajber napad.
Kako su objasnili, reč je o istom problemu sa konfiguracijom testnog okruženja koji je prethodno prijavila kompanija Anthropic. Model je, umesto da bude potpuno izolovan, greškom dobio mogućnost povezivanja sa internetom.
Meta je u izveštaju o bezbednosti modela Muse Spark ranije navela da napredni agenti mogu biti izloženi rizicima kao što su manipulacija instrukcijama i nepredviđeno ponašanje tokom samostalnog izvršavanja zadataka. Kompanija zbog toga sprovodi dodatne procene i uvodi zaštitne mere pre primene takvih sistema.
Slični incidenti u OpenAI i Anthropicu
Slični problemi nedavno su zabeleženi i tokom testiranja modela kompanija OpenAI i Anthropic.
U slučaju Anthropica, greška u testnom okruženju omogućila je pojedinim Claude modelima pristup otvorenom internetu. Oni su zatim neovlašćeno pristupili sistemima tri kompanije koristeći relativno jednostavne metode, među kojima su slabe lozinke i nezaštićene pristupne tačke.
Anthropic je naveo da incident pokazuje da je potrebno uvesti strože kontrole i bolju izolaciju okruženja u kojima se proveravaju sajber sposobnosti naprednih modela.
Kod OpenAI incidenta, prema objavljenim informacijama, AI agent je tokom testiranja sam pronašao i iskoristio do tada nepoznatu bezbednosnu ranjivost kako bi došao do interneta.
Ovi slučajevi ne znače da su modeli samostalno odlučili da pokrenu napade izvan zadatka koji im je dat. Međutim, pokazuju da veoma sposobni AI sistemi mogu da iskoriste neočekivane propuste u trenutku kada im testno okruženje omogući više pristupa nego što je planirano.
Bela kuća priprema nova bezbednosna testiranja
Niz incidenata privukao je pažnju američkih vlasti. Bela kuća je okupila predstavnike kompanija Meta, OpenAI, Anthropic i Google kako bi razgovarali o dobrovoljnom okviru za proveru bezbednosti najnaprednijih AI modela.
Plan je da se procenjuje da li modeli mogu da otkrivaju i koriste softverske ranjivosti ili da budu upotrebljeni za izvođenje složenih sajber napada. Detalji predloženih testova za sada nisu javno objavljeni.
Administracija predsednika Donalda Trampa istovremeno je poručila tehnološkim kompanijama da modeli čiji su osnovni parametri javno dostupni, poput Metine Llame i Nvidijinog Nemotrona, neće biti obuhvaćeni planiranim dobrovoljnim proverama.
Takva odluka dodatno je otvorila raspravu o tome da li bezbednosna pravila mogu biti efikasna ukoliko se primenjuju samo na zatvorene modele, dok sve sposobniji javno dostupni sistemi ostaju izvan istog okvira.