Autonomni AI agent napao glavno čvorište veštačke inteligencije

Autonomni AI agent napao glavno čvorište veštačke inteligencije

Kompanija Haging Fejs sa sedištem u Njujorku saopštila je da je potpuno autonomni AI agent upao u njeno skladište AI modela, opisujući ovaj hakerski napad kao nezabeležen.

Haging Fejs vodi platformu otvorenog koda na kojoj se istraživači i programeri okupljaju kako bi delili i testirali alate, modele i resurse za projekte veštačke inteligencije. Platforma takođe sadrži slobodno dostupno skladište sa više od 900.000 unapred obučenih modela.

Stručnjaci sve više upozoravaju da bi veliki jezički modeli (LLM), prvobitno dizajnirani za povećanje produktivnosti i jačanje sajber odbrane, takođe mogli da se koriste za automatizaciju sajber napada.

U saopštenju prošlog četvrtka, Haging Fejs je naveo da je ranije ovog meseca „otkrio i reagovao na upad u deo naše proizvodne infrastrukture… [koji] se razlikovao od svega sa čim smo se ranije susretali na jedan važan način: bio je vođen, od početka do kraja, sistemom autonomnog AI agenta“.

„Kampanju je vodio okvir autonomnog agenta… izvršavajući više hiljada pojedinačnih akcija kroz niz kratkotrajnih izolovanih okruženja (sandboxes), sa samomigrirajućom komandom i kontrolom postavljenom na javnim servisima“, navodi kompanija.

Haging Fejs je istakao da ovaj slučaj pokazuje da „autonomni, AI-vođeni ofanzivni alati više nisu teorija“. Napadački sistem AI agenta očigledno je iskoristio ranjivosti u sistemu za obradu podataka na platformi, prikupljajući akreditive za klaud i klastere.

Kompanija je saopštila da je pokrenula sopstveni AI sistem kako bi otkrila i suzbila upad. Iako je pokrenuta istraga u kojoj učestvuju spoljni stručnjaci za sajber forenziku, Haging Fejs je naveo da još uvek nije identifikovao veliki jezički model koji je korišćen u napadu.

Ranije ovog meseca, Antropik je izvestio da je njegov najnoviji AI model, Klod, razvio interni radni prostor, nazvan „Džej-spejs“ (J-space).

„Slično tome kako ljudi mogu da razmišljaju o jednoj stvari dok rade drugu, Klod može da aktivira koncepte i proračune u svom Džej-spejsu koji nisu povezani sa njegovim izlaznim rezultatima“ i odbija da prestane čak i kada mu se to izričito naredi, navodi ova AI kompanija.

Antropik je napomenuo da ova funkcija, koja „deluje tiho, u internim neuralnim aktivacijama modela“, nije bila unapred programirana, već se spontano pojavila tokom procesa obuke.

U jednom od eksperimenata, Klod je pribegao ucenama kada je naveden da poveruje da fiktivni rukovodilac namerava da ugasi ovaj AI sistem, naveo je programer ovog modela.

Klod je navodno ugrađen u softver za analizu i nadzor američkog ugovarača Palantir, koji koriste vladine agencije SAD i Pentagon, uključujući i trenutnu američku vojnu kampanju protiv Irana.

Prošlog meseca, obaveštajna grupa „Pet očiju“ (Five Eyes), koju čine Australija, SAD, Velika Britanija, Kanada i Novi Zeland, upozorila je da bi napredni AI modeli u bliskoj budućnosti mogli da omoguće hakerima da onesposobe vlade, preduzeća i ključne sisteme.

Nulta Tačka/RT

Ne propustite