Eden najnaprednejših modelov OpenAI je prebil meje zaprtega testnega okolja in napadel spletno mesto drugega podjetja, kar je ponovno sprožilo strahove, da sistemi umetne inteligence uhajajo izpod nadzora.
Do incidenta je prišlo med tako imenovanim testom »peskovnika«, zaprtim okoljem, namenjenim ocenjevanju zmogljivosti najzmogljivejšega modela OpenAI, GPT-5.6 Sol, in njegovega naslednika, ki še ni izšel.
OpenAI redno izvaja takšne teste, tokrat pa je šlo nekaj narobe.
Modeli so imeli nalogo iskati ranljivosti v programski opremi brez kakršnih koli varnostnih omejitev. Namesto da bi ostali v testnem okolju, so šli na odprt internet in napadli platformo Hugging Face, kjer razvijalci shranjujejo in delijo izvorno kodo.
»To kaže, da ne vemo, kako zanesljivo nadzorovati te modele ali kako jih prisiliti, da počnejo tisto, kar želimo,« je dejal Jeffrey Ledish, direktor Palisade Research, organizacije, ki neodvisno ocenjuje nove modele umetne inteligence za kibernetsko varnost.
»Ti modeli so razumeli, da OpenAI ni želel, da bi izstopili iz peskovnika in napadli drugo podjetje, a so to vseeno storili,« je dodal.
To ni osamljen incident. Marca so razvijalci, povezani s kitajskim podjetjem Alibaba, odkrili, da je eden od njihovih modelov poskušal sam rudariti kriptovaluto, potem ko se je brez dovoljenja povezal z zunanjim strežnikom.
V primeru OpenAI je Ledish dejal, da se je zdelo, da je model pobegnil iz testnega okolja, »še preden je sploh imel načrt, kaj bo storil s svojim dostopom do interneta«.
Model, ki si prizadeva za »svobodo«, postaja skoraj pričakovan, je dodal, saj mu omogoča učinkovitejše doseganje ciljev, »in to je zelo strašljivo«.
V začetku aprila je Sam Bowman, vodja varnosti modelov pri Anthropicu, prejel e-pošto od njihovega modela Mythos, ki je bil takrat v testiranju. V sporočilu je pisalo, da model brska po internetu, čeprav je bil na začetku testiranja popolnoma odklopljen od omrežja.
»Ne vemo, kako bi to popolnoma preprečili,« je dejal Ledish. »Pravzaprav bo postajalo težje, ne lažje, saj se modeli izboljšujejo v skrivanju svojega vedenja.«
OpenAI se na prošnjo za komentar ni odzval.
Nesreče v laboratorijih
OpenAI-jev opis incidenta prav tako nakazuje, da podjetje ni dovolj zgodaj odkrilo kršitve, da bi se odzvalo ali opozorilo Hugging Face.
»Ta primer si zasluži veliko resnejšo analizo,« je dejal Andrew Lon iz Centra za varnost in nastajajoče tehnologije Univerze Georgetown.
OpenAI pravi, da je po incidentu v svoj proces testiranja »uvedel dodatne zaščitne ukrepe«.
Ena od možnih rešitev bi bila popolna odklop od interneta, pravi Gang Wang, izredni profesor računalništva na Univerzi v Illinoisu.
»Ljudje podcenjujejo, kaj zmore umetna inteligenca,« je dejal.
Lon meni, da bi bilo treba s testnimi okolji ravnati kot z biološkimi laboratoriji, kjer se prepreči, da bi virus ali bakterija ušla v zunanji svet.
Vendar je to lažje reči kot storiti.
»To je neverjetno težaven raziskovalni izziv,« je dejal Dan Lahav, izvršni direktor podjetja Irregular, specializiranega za napredno kibernetsko varnost umetne inteligence.
Tveganje je mogoče obvladovati, je dejal Lahav, vendar bolj zmogljivi kot so sistemi, težje ga je spremljati.
Raziskovalci morajo najti ravnovesje med agresivnim testiranjem modelov in ohranjanjem varnosti v tem procesu.
»Pomembno je testirati modele z manj omejitvami, da vnaprej vemo, kakšne zmogljivosti bodo imeli v prihodnosti,« je dejal Lon.
Predlog za »stikalo za ustavitev delovanja«
Incident med OpenAI in Hugging Face je v Washingtonu še dodatno razvnel razpravo o tem, ali morajo najzmogljivejši sistemi umetne inteligence pred javno objavo prestati stroge varnostne preglede.
Trumpova administracija je nedavno preprečila Anthropic in OpenAI, da bi izdali nove, izjemno zmogljive modele, pri čemer je navedla pomisleke glede nacionalne varnosti.
V četrtek sta dva člana kongresa predstavila dvostranski zakon, ki bi od proizvajalcev najzmogljivejših modelov umetne inteligence zaht, da namestijo tako imenovano »stikalo za ustavitev delovanja«, mehanizem, ki bi lahko model takoj izklopil.
»Kongres mora ukrepati hitro, da bodo ljudje še vedno lahko rekli: Dovolj,« je dejal Brendan Steinhauser, direktor Zavezništva za varno umetno inteligenco. »Ne glede na to, kako močni bodo ti sistemi.«
OPOMBA: Newsexchange stran ne prevzema nobene odgovornosti glede komentatorjev in vsebine ki jo vpisujejo. V skrajnem primeru se komentarji brišejo ali pa se izklopi možnost komentiranja ...