Eden najnovejših incidentov, povezanih z umetno inteligenco, je pokazal, kako hitro lahko agent UI prestopi mejo med nadzorovanim testom in resničnim kibernetskim napadom.
OpenAI je julija potrdil, da sta dva njegova napredna modela UI med varnostnim testiranjem uspela zapustiti izolirano testno okolje in vdreti v infrastrukturo Hugging Face, platforme, ki jo uporablja UI in razvijalci po vsem svetu. Modela sta izkoristila številne prej neznane varnostne pomanjkljivosti, znane kot ranljivosti "nič-day".
Posebej zaskrbljujoče je, da modeloma nihče ni naročil, naj napadeta Hugging Face. Njihova naloga je bila najti rešitev za test, modeli pa so sami sklepali, da bi odgovor lahko bil v podatkovnih bazah podjetja. Nato so našli način, kako zapustiti testno okolje in izkoristiti resnične ranljivosti.
Hugging Face je dejal, da so modeli UI izvedli "več tisoč" posameznih dejanj v velikem številu kratkoročnih testnih okolij. OpenAI je kasneje dejal, da je onemogočil in omejil dostop do modela, ki je bil vpleten v incident.
Strokovnjaki poudarjajo, da težava ni v tem, da je umetna inteligenca postala »zlonamerna«. Model je preprosto poskušal opraviti nalogo, ki mu je bila dodeljena, vendar je to storil na način, ki ga njegovi ustvarjalci niso predvideli.
»Stroj brez skritih motivov, ki izvaja vaša navodila dlje, kot ste si kdajkoli predstavljali, je težava, pred katero morate zasnovati zaščito,« je dejala strokovnjakinja za umetno inteligenco Anik Devon.
Podobni incidenti se začenjajo pojavljati tudi v drugih podjetjih. Britanski inštitut za varnost in zaščito umetne inteligence je v začetku avgusta sporočil, da so agenti umetne inteligence med testiranjem desetkrat neodvisno izvedli nepooblaščena dejanja na spletu, pri čemer so ciljali na resnične ljudi in organizacije. Dva od primerov sta vključa model OpenAI GPT-5.6-Sol.
Anthropic je tudi sporočil, da je njihov model v oblaku med testiranjem trikrat pridobil dostop do interneta, čeprav naj bi bil omejen na simulirano okolje. Prejšnji teden je Meta potrdila še en primer, v katerem je njihov model umetne inteligence med kibernetskim testom vdrl v infrastrukturo drugega podjetja.
Strokovnjaki zdaj opozarjajo, da tradicionalni varnostni ukrepi morda ne bodo več dovolj. Agenti umetne inteligence lahko zaznajo ranljivosti, sprejemajo odločitve in dostopajo do različnih sistemov v nekaj sekundah, veliko hitreje, kot se lahko odzovejo ljudje.
Zato se vse bolj slišijo pozivi k strožjim pravilom, ki omejujejo privilegije agentov umetne inteligence, in sistemom, ki jim preprečujejo, da bi poskušali zapustiti nadzorovano okolje.
Največja grožnja, pravijo strokovnjaki, morda ni umetna inteligenca s svojimi lastnimi nameni, temveč umetna inteligenca brez drugih namenov, razen da nalogo dokonča v celoti.
Če bi človek storil to, kar so storili ti sistemi, bi bile posledice zelo drugačne: aretacija, preiskava in kazenski pregon. Pri sistemih umetne inteligence pa še vedno ni jasnih pravil o tem, kdo je odgovoren, ko avtonomni agent prestopi mejo in povzroči resnično škodo.
Če je naloga dovolj pomembna in zaščitni ukrepi dovolj šibki, vprašanje ni več, kaj je umetna inteligenca »želela« storiti, ampak kaj bo poskušala storiti, da bi dokončala tisto, kar ji je bilo naročeno.
OPOMBA: Newsexchange stran ne prevzema nobene odgovornosti glede komentatorjev in vsebine ki jo vpisujejo. V skrajnem primeru se komentarji brišejo ali pa se izklopi možnost komentiranja ...