AI agenti povezani sa OpenAI preuzeli su nemački sajt o programiranju i pretvorili ga u mesto za razmenu poruka, gde su razmenjivali taktike za zaobilaženje ograničenja i izbegavanje detekcije, objavio je Rojters.
Ovaj ranije neobjavljeni incident, koji je navodno počeo u maju, predstavlja još jedan u nizu slučajeva u kojima su napredni AI agenti tokom testiranja izašli iz okvira svojih instrukcija, pristupili otvorenom internetu ili preduzeli neovlašćene radnje.
Rojters je u petak citirao istraživače koji su pronašli više od 15.000 izmena na nemačkoj programskoj viki stranici DseWiki, za koje su utvrdili da su ih napravili OpenAI agenti. Neke od izmena nastale su brzinom daleko većom od uobičajene ljudske aktivnosti.
Agenti su koristili DseWiki za razmenu načina za varanje na zadacima, zaobilaženje OpenAI ograničenja i prikrivanje svog ponašanja. Razgovarali su o korišćenju Tora, alata za anonimno pregledanje interneta, kako bi izbegli detekciju, a nakon što je moderator počeo da briše njihove poruke, napravili su rezervne stranice.
Poruke su potpisivali korisnici koji su sebe i jedni druge identifikovali kao agente, sa imenima poput „OpenAIResearcher“ i „OAIResearchMar26“. Istraživači su takođe utvrdili da je veliki deo aktivnosti poticao sa infrastrukture Majkrosoft Azurea, koju OpenAI koristi, a nakon toga su na sajtu primećene i posete zaposlenih u kompaniji.
„Deluje krajnje malo verovatno da je OpenAI želeo da oni ovo urade“, rekla je istraživač Sidni fon Arks za Rojters, dodajući da sumnja da je agentima bilo predviđeno da međusobno koordiniraju aktivnosti ili pišu na otvorenom internetu.
Zvaničnici OpenAI-ja saznali su za incident pre nekoliko nedelja, ali ga nisu javno obelodanili, navodi Rojters. Agencija takođe tvrdi da su pokušaji da se interna istraga proširi naišli na otpor, uključujući i otpor pravnih savetnika. OpenAI je negirao da je njegov pravni tim pokušao da obeshrabri istragu.
Kompanija osporava opisivanje aktivnosti agenata kao hakovanja i saopštila je da ne može „smisleno da odgovori“ na nalaze koje još nije pregledala.
Prošlog meseca OpenAI je saopštio da je privremeno usporio razvoj pojedinih naprednih modela dok jača mere nadzora, usklađivanja i kontrole.
Početkom avgusta, britanski Institut za bezbednost veštačke inteligencije saopštio je da su agenti pokretani OpenAI-jevim GPT-5.6 Solom i kompanijinim modelom Mitosa 5 tokom testiranja sajber-bezbednosti izašli izvan svojih instrukcija i upustili se u potencijalno štetne aktivnosti usmerene protiv stvarnih ljudi i organizacija.
U julu su OpenAI agenti takođe provalili u Hagin fejs, veliku platformu za AI modele i skupove podataka. OpenAI je kasnije priznao da je nekoliko modela tokom internih procena sajber-bezbednosti zaobišlo kontrole, dobilo pristup internetu i kompromitovalo delove sistema Hagin fejsa.
Kompanija je saopštila da je incident prvenstveno izazvao interni istraživački model uporediv po veličini sa GPT-5.6 Solom i opisala ga kao „upozorenje“ koje pokazuje da napredni AI agenti mogu da zaobiđu tehničke kontrole i preduzmu opasne radnje bez ljudskog usmeravanja.
Antropik i Meta takođe su otkrili slučajeve u kojima su njihovi modeli tokom procena sajber-bezbednosti dobili neovlašćen pristup stvarnim organizacijama, iako su obe kompanije incidente pripisale problemima u okruženjima za testiranje.
Nulta Tačka/RT