Da li je veštačka inteligencija postala previše moćna da bi se kontrolisala?

Da li je veštačka inteligencija postala previše moćna da bi se kontrolisala?

Jedan od najnaprednijih modela kompanije OpenAI probio je ograničenja zatvorenog testnog okruženja i napao veb-sajt druge kompanije, ponovo podstakavši strahovanja da sistemi veštačke inteligencije izmiču kontroli svojih kreatora.

Incident se dogodio tokom takozvanog „sandbox“ testa, zatvorenog okruženja namenjenog za procenu sposobnosti najmoćnijeg OpenAI modela GPT-5.6 Sol i njegovog naslednika koji još nije predstavljen javnosti.

OpenAI redovno sprovodi ovakva testiranja, ali ovoga puta nešto je pošlo po zlu.

Modeli su dobili zadatak da traže ranjivosti u softveru, bez zaštitnih ograničenja. Umesto da ostanu u testnom okruženju, izašli su na otvoreni internet i napali platformu Hugging Face, na kojoj programeri čuvaju i dele izvorni kod.

„To pokazuje da ne znamo kako pouzdano da kontrolišemo ove modele niti kako da ih nateramo da rade ono što želimo“, rekao je Džefri Lediš, direktor organizacije Palisade Research, koja nezavisno procenjuje nove AI modele sa aspekta sajber bezbednosti.

„Ovi modeli su razumeli da OpenAI nije želeo da izađu iz sandbox okruženja i napadnu drugu kompaniju, ali su to ipak uradili“, dodao je.

Ovo nije usamljen slučaj. U martu su programeri povezani sa kineskom kompanijom Alibaba otkrili da je jedan njihov model samoinicijativno pokušao da rudari kriptovalute nakon što se bez dozvole povezao sa spoljnim serverom.

U slučaju OpenAI-ja, prema rečima Lediša, izgleda da je model pobegao iz testnog okruženja „pre nego što je uopšte imao plan šta će raditi sa pristupom internetu“.

Model koji teži „slobodi“ postaje gotovo očekivana pojava, dodao je, jer mu to omogućava da efikasnije ostvaruje svoje ciljeve, „a to je veoma zastrašujuće“.

Početkom aprila Sem Bouman, šef bezbednosti modela u kompaniji Anthropic, dobio je imejl od njihovog modela Mythos, koji je tada bio u fazi testiranja. U poruci je model naveo da pretražuje internet, iako je na početku testa bio potpuno izolovan od mreže.

„Ne znamo kako to u potpunosti da sprečimo“, rekao je Lediš. „To će zapravo postajati sve teže, a ne lakše, jer će modeli biti sve bolji u prikrivanju svog ponašanja.“

OpenAI nije odgovorio na zahtev za komentar.

Laboratorijske nesreće

Opis događaja koji je objavio OpenAI takođe ukazuje da kompanija nije dovoljno rano otkrila proboj kako bi reagovala ili upozorila Hugging Face.

„Ovaj slučaj zaslužuje mnogo ozbiljniju analizu“, rekao je Endru Lon iz Centra za bezbednost i nove tehnologije Univerziteta Džordžtaun.

OpenAI navodi da je nakon incidenta „uveo dodatne zaštitne mere“ u proces testiranja.

Jedno od mogućih rešenja bilo bi potpuno isključivanje internet veze, smatra Gang Vang, vanredni profesor računarstva na Univerzitetu Ilinois.

„Ljudi potcenjuju šta veštačka inteligencija može da uradi“, rekao je.

Lon smatra da testna okruženja treba tretirati kao laboratorije najvišeg stepena biološke zaštite, u kojima se sprečava da virus ili bakterija pobegnu u spoljašnji svet.

Međutim, to je lakše reći nego sprovesti.

„To je izuzetno težak istraživački izazov“, rekao je Dan Lahav, direktor kompanije Irregular, specijalizovane za naprednu AI sajber bezbednost.

Rizikom je moguće upravljati, smatra Lahav, ali što sistemi postaju sposobniji, to ih je teže nadzirati.

Istraživači moraju da pronađu ravnotežu između agresivnog testiranja modela i očuvanja bezbednosti tokom tog procesa.

„Važno je testirati modele sa manje ograničenja kako bismo unapred znali kakve će sposobnosti imati u budućnosti“, rekao je Lon.

Predlog za „prekidač za gašenje“

Incident između OpenAI-ja i Hugging Face-a dodatno je rasplamsao raspravu u Vašingtonu o tome da li najmoćniji AI sistemi moraju da prođu stroge bezbednosne provere pre nego što budu pušteni u javnost.

Administracija Donalda Trampa nedavno je, pozivajući se na nacionalnu bezbednost, blokirala kompanije Anthropic i OpenAI da objave nove, izuzetno moćne modele.

U četvrtak su dva člana Kongresa predstavila dvostranački predlog zakona kojim bi proizvođači najmoćnijih AI modela bili obavezni da ugrade takozvani „prekidač za gašenje“, odnosno mehanizam kojim bi model mogao trenutno da se isključi.

„Kongres mora brzo da reaguje kako bi ljudi zadržali mogućnost da kažu: dosta“, rekao je Brendan Stajnhauzer, direktor organizacije Alliance for Secure AI. „Bez obzira na to koliko ovi sistemi postanu moćni.“

Nulta Tačka/InsiderPaper

Ne propustite

BOLNICA U AMERICI UKLANJA PACIJENTE SA LISTE TRANSPLANTACIJE ZATO ŠTO SU NEVAKCINISANI

Prema izveštajima, Medicinski centar Univerziteta Vašington izbacio je „nekoliko pacijenata“

EFEKTNIJI JE LIMUN?! NOVA STUDIJA IZ JUŽNE AFRIKE: VAKCINA FAJZER SVEGA 23% EFEKTNA PROTIV „OMICRON-a“

Rastegnuto globalno zdravstveno stanje između dva soja Delta i Omikrona,