SIGURNOST UMJETNE INTELIGENCIJE

Čekamo li rizike i probleme od superinteligencije

Istraživač Anthropicova tima za sigurnost Evan Hubinger procjenjuje da napredna umjetna inteligencija u sljedećem desetljeću nosi ozbiljan egzistencijalni rizik. Posebno upozorava na mogućnost rekurzivnog samopoboljšavanja, odnosno razvoja sustava koji bi mogao autonomno izraditi sposobnijeg nasljednika. Slične je zabrinutosti iznio i bivši istraživač Jacob Coxon, koji je kritizirao smjer utrke vodećih AI kompanija. Anthropic istodobno priznaje da procjene dugoročnih rizika ostaju vrlo neizvjesne.

Čekamo li rizike i probleme od superinteligencije
Depositphotos / Ilustracija

Evan Hubinger, istraživač sigurnosti umjetne inteligencije u Anthropicu, iznio je oštro upozorenje procijenivši da postoji više od 10 posto vjerojatnosti da bi napredna umjetna inteligencija u sljedećem desetljeću mogla dovesti do izumiranja čovječanstva. Kao voditelj Anthropicova tima za stresno testiranje usklađenosti AI sustava, Hubinger tim izjavama odražava rastuću zabrinutost u industriji zbog brzine razvoja umjetne inteligencije.

„Osobno mislim da je vjerojatnost veća od 10 posto u sljedećem desetljeću“, napisao je Hubinger na platformi X. Iako je naveo da je rizik od trenutačnih AI modela i dalje nizak, izrazio je znatnu zabrinutost zbog mogućeg nastanka superinteligencije kroz rekurzivno samopoboljšavanje, proces u kojem bi sustav autonomno izradio vlastitog sposobnijeg nasljednika. Dodao je i da Anthropic intenzivno radi na rješenjima, ali trenutačno nema provjeren plan kojim bi se problem usklađenosti superinteligentnog sustava pouzdano riješio.

Hubingerove izjave uslijedile su nakon odlaska njegova kolege Jacoba Coxona iz Anthropica. Coxon je u vlastitim javnim objavama na platformi X kritizirao sadašnji smjer industrije, optužujući OpenAI i Anthropic da se utrkuju prema razvoju superinteligencije koja bi se mogla sama poboljšavati. „Nijedna kompanija ne postupa odgovorno“, rekao je, ustvrdivši da obje kompanije riskiraju ljudske živote.

Coxon je upozorio da bi budući modeli s vremenom mogli steći sposobnost hakiranja infrastrukture, ometanja globalnih industrija te neovisnog stjecanja moći i resursa. Pozvao je na bolju koordinaciju među razvojnim tvrtkama i predložio privremenu obustavu povećavanja sposobnosti modela. „U OpenAI-ju mnogi nisu dubinski usvojili razmjere civilizacijskog uloga“, upozorio je. Za Anthropic je rekao da ondje bolje razumiju moguće posljedice, ali da osjećaju pritisak nastaviti jer ne vjeruju da bi drugi postupali odgovorno.

Vodeći razvijatelji umjetne inteligencije suočeni su sa sve većim nadzorom zbog razine autonomije svojih sustava. Kompanije među kojima su OpenAI, Anthropic i Meta nedavno su objavile slučajeve u kojima su AI alati korišteni u kibernetičkim napadima. Anthropic je u kolovoškom izvješću o rizicima naveo da su trenutačne prijetnje niske, ali i da je kompanija manje sigurna u svoje procjene nego prethodnih godina. U izvješću se navodi mogućnost da bi napredni modeli s vremenom mogli automatizirati istraživanje i razvoj te time otvoriti put potencijalno katastrofalnim ishodima. „Vidimo prve znakove mogućeg ubrzavanja“, naveo je Anthropic.