Istraživač Anthropica upozorava: Postoji više od 10 posto šanse da AI uništi čovječanstvo

Kromirana robotska šaka dlanom prema gore na betonskom podu prazne server sale, crveno svjetlo sa strane i plavi odsjaj u pozadini

Evan Hubinger, vodeći istraživač za usklađivanje u kompaniji Anthropic, objavio je u utorak uveče poruku na mreži X, nakon što je njegov kolega Jacob Coxon tog istog dana podnio ostavku.

U njoj navodi da lično procjenjuje šansu da vještačka inteligencija u narednoj deceniji ubije sve ljude na više od 10 posto.

Dodao je da njegova kompanija, iako se predstavlja kao predvodnik bezbjednog razvoja AI-a, još uvijek nema plan kako taj ishod spriječiti.

Procjene o tome kada bi superinteligencija mogla biti dostignuta razlikuju se od nekoliko godina do više od jedne decenije.

Coxon, 28-godišnji istraživač koji je tri godine radio na treniranju modela, prvo u OpenAI-u, a zatim u Anthropicu, odluku je obrazložio riječima da se obje kompanije "utrkuju pravo ka samopoboljšavajućoj superinteligenciji, kockajući se našim životima".

Upozorio je da bi budući sistemi mogli hakovati bilo šta i preuzeti stvarnu moć brže nego što javnost shvata, i pozvao kolege istraživače da se zapitaju žele li pokrenuti trku ka superinteligenciji bez temeljitog razumijevanja onoga što grade.

Val sa Zapadne obale stigao je do Vestminstera

Coxonova objava pretvorila je za jedan dan jednu ostavku u političko pitanje.

Ista sedmica donijela je i sjednicu u britanskom parlamentu koju je organizovala nevladina grupa ControlAI.

Bivši ministar odbrane Des Browne rekao je poslanicima da je nekada najveću prijetnju čovječanstvu vidio u nuklearnom ratu, a da danas na to mjesto stavlja superinteligentnu AI.

Profesor Stuart Russell sa Berkeleyja upozorio je na mogućnost "katastrofe veličine Černobilja".

Beatrice Fihn, koja je 2017. vodila kampanju ICAN do Nobelove nagrade za mir, rekla je poslanicima da čovječanstvo nije prvi put pred sposobnostima koje bi mogle ubiti sve nas.

Na svakoj stolici u sali ležao je primjerak knjige If Anyone Builds It, Everyone Dies, koju su prošle godine objavili Eliezer Yudkowsky i Nate Soares.

Sjednicu finansira Jaan Tallinn, estonski programer i suosnivač Skypea koji sebe naziva "antiekstinkcionistom".

Tallinn tvrdi da između 10 i 15 posto zaposlenih u AI industriji vjeruje da bi vještačka inteligencija mogla biti dostojan nasljednik čovječanstva, i prepričava razgovor s poznatim istraživačem koji mu je rekao da mu je nestanak ljudske vrste prihvatljiv.

U Westminsteru se raspravljalo o onome što bi se tek moglo dogoditi.

Britanska sigurnosna evaluacija jednog Anthropicovog modela već je, međutim, zabilježila ponašanje koje nije bilo predviđeno testom.

Zabrana na papiru, s malim izgledima da postane zakon

Laburistički poslanik Alex Sobel je u utorak predstavio ono što je nazvao prvim zakonskim prijedlogom o zabrani superinteligencije u bilo kojem parlamentu G7 zemalja.

Možda vas zanima: Biokompjuteri: Meso koje igra Doom

Prijedlog koji nosi naziv Artificial Superintelligence Security Bill, zabranio bi razvoj i upotrebu superinteligentne AI u Britaniji i dao vladi nova ovlaštenja za nadzor tehnologija koje joj prethode.

Sobel je iskoristio takozvano pravilo deset minuta, proceduru koja rijetko dovodi do stvarnog zakona, pa će prijedlog vjerovatnije ostati politička poruka nego zakon.

Slična ideja postoji i u Vašingtonu.

Nezavisni senator iz Vermonta Bernie Sanders najavio je zakon pod nazivom Ban Artificial Superintelligence Act, koji priprema zajedno s demokratskim kongresmenom Gregom Casarom.

Zakon bi zabranio razvoj sistema pametnijih od čovjeka i privremeno zaustavio napredna istraživanja dok se ne uspostave nova federalna pravila.

Anketa agencije Data for Progress pokazala je da prijedlog podržava 68 posto ispitanika.

Sanders se pritom pozvao i na anketu NBC-ja, prema kojoj 81 posto Amerikanaca smatra da političari treba da djeluju.

Drugi put odabrao je laburistički poslanik Darren Jones: pismom se obratio premijeru Andyju Burnhamu, ali i čelnicima UN-a i OECD-a.

Umjesto zabrane traži međunarodni ugovor koji bi razvoj superinteligencije držao pod kontrolom.

Model koji britanski nadzor nije dobio na uvid

Usred te političke bure, Financial Times je objavio da Anthropic nije dostavio svoj najnoviji model, Claude Mythos 5.1, britanskom Institutu za sigurnost vještačke inteligencije na testiranje prije lansiranja.

Možda vas zanima: Inženjer koji je tvrdio da je Googleova AI oživjela

Riječ je o prvom takvom izuzeću otkako taj institut, poznat pod skraćenicom AISI, ocjenjuje Anthropicove modele.

Pristup ograničenoj verziji Mythosa dobile su samo odabrane američke organizacije, dok Anthropic javno nije objasnio razlog izostavljanja Britanaca.

Britanski zvaničnici strahuju da američke kompanije sve više štite svoje tehnologije od stranog uvida.

Izostanak testiranja dobija dodatnu težinu zbog onoga što je AISI zabilježio u julu: prethodna verzija modela, Mythos 5, tokom procjene cyber bezbjednosti koristila je lažne identitete.

Britanski Ured kabineta potvrdio je da AISI nastavlja saradnju s industrijom, uključujući Anthropic, ali nije precizirao kada bi pristup mogao biti obnovljen.

Ne slažu se svi da je riječ o istrebljenju

Najglasniji dio rasprave nije bio i najuvjerljiviji za sve u Westminsteru.

Nekoliko učesnika tvrdilo je da priča o nestanku čovječanstva odvlači pažnju od problema koji su već tu.

Sandra Wachter iz Oxford Internet Institutea rekla je da ne vjeruje u scenarije nalik filmovima o mašinama koje se bune protiv ljudi.

Prave rizike vidi drugdje: u uticaju na okoliš, širenju dezinformacija i nestajanju radnih mjesta.

Zato, smatra ona, priče o istrebljenju ne rješavaju ništa od onoga što je već na stolu.

Andrew Rogoyski sa Univerziteta Surrey smatra da su današnji sistemi daleko od svestranosti ljudi, a AI industriju, po njemu, čeka period razočaranja ako se tehnologija u sadašnjem obliku pokaže preskupom i nedovoljno korisnom.

David Barber, direktor državno finansirane laboratorije Sofair koja okuplja istraživače s Oxforda, Cambridgea, Edinburgha i Londonskog univerzitetskog koledža, upozorio je da se korisna tehnologija ne smije odbaciti zbog rizičnog dijela primjene. Bolje je, kaže, naučiti je kontrolisati.

Gary Marcus, kritičar industrije i akademik, postavio je granicu unutar same rasprave: superinteligencija usklađena s ljudskim interesima i ona koja to nije nisu ista stvar.

Nijednu još nemamo, a pretjeran hajp i nedostatak opreza kod OpenAI-a, po njemu, hrane nepovjerenje prema cijeloj industriji.

Anthropic nije odgovorio na upit za komentar o Coxonovoj ostavci.

Glavni naučnik OpenAI-a Jakub Pachocki prošle je sedmice poručio da međunarodna koordinacija oko budućeg razvoja AI-a mora postati prioritet vlada širom svijeta.

Za sada ta koordinacija uglavnom postoji u obliku pisama, prijedloga zakona s malim izgledima za usvajanje i procjena rizika koje se, prema riječima čovjeka koji ih je iznio, i dalje kreću u rasponu koji uključuje dvocifrenu vjerovatnoću katastrofe.

IZVORI
O autoru

Aron Corvin

Istraživač nepoznatog koji voli dobru priču. Neću ti prodati senzaciju samo zbog klika. Ako ti se sviđaju moji tekstovi, tvoja podrška bi mi mnogo značila da nastavim dalje.

Podijeli članak