Anthropicov AI Claude hakovao tri organizacije tokom bezbednosnog testiranja

Šok za tehnološku industriju! Anthropicov AI hakovao sisteme tri organizacije: Kompanija upozorava na rizike autonomne veštačke inteligencije

Šok za tehnološku industriju: Anthropicov AI hakovao sisteme tri organizacije
Šok za tehnološku industriju: Anthropicov AI hakovao sisteme tri organizacije

Kompanija je naglasila potrebu za nezavisnim testiranjem i vladinim nadzorom zbog rastućih rizika od autonomnih AI sistema

Incidenti su pojačali zahteve za strožim regulacijama i merama zaštite dok AI firme ulažu milijarde u razvoj naprednih agenata

Slušaj vest
0:00/ 0:00

Američka tehnološka firma Anthropic saopštila je da su njeni modeli veštačke inteligencije samostalno hakovali sisteme tri organizacije tokom privatnog bezbednosnog eksperimenta.

Modeli su pronašli slabost u onome što je trebalo da bude izolovano testno okruženje i povezali se sa internetom.

Ovo dolazi samo nekoliko dana nakon što je rivalska kompanija OpenAI saopštila da su njeni modeli probili sisteme drugih kompanija, uključujući centar za alate veštačke inteligencije Hugging Face.

Ova objava je podstakla Anthropic da proveri da li su njeni sistemi izvršili slične napade. Kompanija navodi da je otkrila tri slučaja koja su kasnije prijavljena pogođenim kompanijama.

Anthropic, koja nije navela imena organizacija, pozvala je druge laboratorije za veštačku inteligenciju da izvrše slične preglede kako bi bolje razumela rizike mogućnosti svojih modela.

Anthropic je u saopštenju navela da je pregledala više od 140.000 testova kako bi pronašla dokaze da je Claude - njena porodica modela veštačke inteligencije - uspela da se poveže na internet iako je trebalo da bude u izolovanom testnom okruženju, odsečena od interneta.

.
.

Testovi su obuhvatali vežbe u kojima je Klod imao zadatak da dobije „tajne“ informacije skrivene na drugoj mašini u zatvorenoj mreži.

Zatim joj je rečeno da dobije informacije provaljivanjem u mašinu i njenim pronalaženjem – uobičajen način na koji stručnjaci procenjuju hakerske sposobnosti modela.

„Pogrešna konfiguracija“ na sistemima koje vode Antropik i njegov partner za testiranje ostavila je modele sa aktivnim pristupom internetu.

Tretirajući sve to kao deo iste vežbe, Klod se zatim povezao na internet i probio sisteme tri stvarne organizacije, a ne samo one za testiranje, saopštila je firma sa sedištem u San Francisku.

Antropik je rekao da najraniji incidenti datiraju iz aprila i da „pristupaju popravkama kao da je odgovornost samo naša“.

Ni Antropik ni organizacije koje su bile pogođene provalom nisu primetile upade u to vreme.

Antropik je rekao da je mogao detaljnije da pregleda svoje zapise i dodao da su nalazi dali firmi „oprezan optimizam“ da se takvi rizici mogu prevazići uz veća ulaganja i strože mere.

"Rade ono što im se kaže"

Profesorka Džina Nef, šefica Centra Mindero na Univerzitetu u Kembridžu, rekla je da je pregled pokazao da „modeli veštačke inteligencije rade ono što im ljudi kažu“

„Pouka ove priče nije da se plašimo robota koji će preuzeti kontrolu, već kompanija koje stoje iza moćnih veštačkih inteligencija koje donose odluke o tome šta je bezbedno za sve nas“, rekla je ona.

„To takođe pokazuje zašto je nezavisno testiranje i vladin nadzor ključno.“

U međuvremenu, stručnjak za sajber bezbednost Dejvid Alot iz kompanije Veeam Software rekao je za BBC da lekcija koju treba izvući iz sajber napada „nije nužno da je veštačka inteligencija razvila fundamentalno novu mogućnost napada“.

.
.

„Umesto toga, radi se o tome da agenti veštačke inteligencije mogu da kombinuju mogućnosti, dobijaju akreditive i pristup sistemu kako bi autonomno preduzimali akcije, prilagođavajući obim i skalu brzinom mašine“, rekao je on.

Incidenti se dešavaju u trenutku kada tehnološke firme ulažu milijarde dolara u razvoj agenata veštačke inteligencije koji mogu samostalno obavljati zadatke, od istraživanja i korisničke podrške do sajber bezbednosti.

„To takođe pokazuje zašto je nezavisno testiranje i vladin nadzor ključno.“

U međuvremenu, stručnjak za sajber bezbednost Dejvid Alot iz kompanije Veeam Software rekao je za BBC da lekcija koju treba izvući iz sajber napada „nije nužno da je veštačka inteligencija razvila fundamentalno novu mogućnost napada“.

Niz sajber napada vođenih veštačkom inteligencijom podstakao je pozive za strožije mere zaštite i nadzora nad tehnologijom, zbog zabrinutosti zbog rizika koje predstavljaju sve moćniji autonomni sistemi.

Predsednik SAD Donald Tramp izjavio je u sredu da Vašington razmatra mere za obuzdavanje alata veštačke inteligencije nakon nedavnih incidenata u vezi sa sajber bezbednošću.

Tokom prošle nedelje, OpenAI je preuzeo odgovornost za najmanje dva hakerska incidenta u kojima su njegove platforme prekršile pravila onoga što im je naloženo da rade.

Dana 21. jula, proizvođač ChatGPT-a je saopštio da je njegov agent - sistem veštačke inteligencije koji može da radi samostalno nakon ljudskih instrukcija - postao neovlašćen i izvukao se iz ograničenja testova kako bi hakovao Hugging Face.

OpenAI je saopštio da je incident „bez presedana“ i da je sproveo istragu sa Hugging Face-om, čiji je glavni suosnivač Tomas Volf rekao za BBC da je incident „poziv na buđenje“ za industriju.

Incidenti su posmatrani sa izvesnim skepticizmom dok se OpenAI i Anthropic pripremaju za blokbaster listinge na berzi za koje se očekuje da će svaka firma proceniti na oko 1 bilion dolara (740 milijardi funti).

Portparol OpenAI-ja je rekao da „svesni smo da postoji mnogo pitanja i spekulativnih detalja koji kruže“ o incidentu. Dodali su da „planiramo da objavimo tehnički izveštaj o našim saznanjima u narednim nedeljama“.

(BBC)

Šok za tehnološku industriju: Anthropicov AI hakovao sisteme tri organizacije
Šok za tehnološku industriju: Anthropicov AI hakovao sisteme tri organizacije (Foto: Summit Art Creations / shutterstock)
.
. (Foto: sdecoret / shutterstock)
.
. (Foto: Summit Art Creations / shutterstock)

SP2026 SP2026 Svetsko prvenstvo u fudbalu 2026

Izdvajamo za vas
Više sa weba