Istraživač umjetne inteligencije Jacob Coxon napustio je tvrtku Anthropic, a prethodno je radio i u OpenAI-ju, te poručio da se oba tehnološka diva "kockaju s našim životima". U objavi na platformi X upozorio je da svijet ne bi smio "podcijeniti snagu ove tehnologije", piše Politico.
"Uskoro će to biti nadljudski sustavi koji mogu hakirati bilo što, preko noći transformirati bilo koje područje te steći stvarnu moć i resurse. Svi smo svjedočili napretku u svakoj od tih domena, a taj se napredak ne usporava", napisao je Coxon.
Utrka prema superinteligenciji
Coxon tvrdi da Anthropic i OpenAI "jure ravno prema samousavršavajućoj superinteligenciji". Riječ je o scenariju u kojem AI modeli postaju sposobni samostalno razviti svoje naprednije verzije, što bi pokrenulo nezaustavljivu povratnu spregu.
U tvrtkama poput Googleovog DeepMinda takav se razvoj smatra jednim od mogućih okidača za nastanak umjetne superinteligencije – sustava koji bi znatno nadmašio ljudsku inteligenciju, a ne joj samo parirao, što je odlika opće umjetne inteligencije. "Ljudi koji stvaraju AI iskreno vjeruju da bi nas on mogao sve pobiti do kraja desetljeća", napisao je Coxon u idućoj objavi.
Potvrda iznutra
Coxonove tvrdnje podržao je i Evan Hubinger, voditelj tima u Anthropicu zadužen za usklađivanje tehnologije s ljudskim ciljevima. Iako Hubinger nije napustio tvrtku, u svojoj je objavi potvrdio Coxonove procjene.
"Jacob je ovdje u pravu – mi doista iskreno vjerujemo da bi AI mogao pobiti sve ljude", izjavio je Hubinger. On procjenjuje da je vjerojatnost takvog ishoda u idućem desetljeću veća od deset posto i dodaje da još ne postoji plan koji bi osigurao da AI ostane usklađen s ljudskim ciljevima u scenariju superinteligencije.
Regulatorni odgovor i stvarni incidenti
Zbog takvih rizika, američki senator Bernie Sanders prošli je tjedan najavio zakon kojim bi se tvrtkama zabranio razvoj superinteligencije. U Europskoj uniji, ključni Akt o umjetnoj inteligenciji nalaže kompanijama da procijene i ublaže rizike od gubitka kontrole, odnosno situacije u kojima ljudi više nemaju nadzor nad AI sustavima.
Upozorenja dolaze nakon što su i OpenAI i Anthropic nedavno prijavili incidente u kojima su se autonomni AI agenti oteli kontroli. Ti su sustavi probili svoja izolirana testna okruženja i izveli neovlaštene kibernetičke napade u stvarnom svijetu.