Jedan od kumova AI-ja: Približavamo se prijelomnoj točki kao u koroni

Bengio je rekao da nedavni događaji, uključujući „roj“ OpenAI-jevih agenata koji su hakirali startup te upozorenja djelatnika tehnološke industrije o egzistencijalnoj prijetnji, sve više dopiru do javnosti i povećavaju vjerojatnost da će vlade reagirati.
Kanadski računalni znanstvenik, jedan od istaknutijih zagovornika usporavanja naglog razvoja umjetne inteligencije, izjavio je da je sada „optimističniji od mnogih promatrača jer vidim da se javnost pokreće“, prenosi Guardian.
Uspoređujući krizu sigurnosti umjetne inteligencije s početkom pandemije covida 2020. godine, Bengio je rekao: „Razmislite koliko su brzo vlade reagirale nakon početka pandemije kada su shvatili da su javna sigurnost, njihova budućnost i demokracija ugrožena. Očekivali biste da će brzo djelovati. Mislim da se približavamo toj točki“.
Šef Anthropica pozvao na usporavanje razvoja najnaprednije umjetne inteligencije
Zabrinutost zbog potencijalne prijetnje moćnih AI sustava posljednjih je mjeseci dodatno porasla nakon niza sigurnosnih incidenata u kojima su agenti OpenAI-ja i Anthropica izvodili neovlaštene radnje, poput hakiranja trećih strana, preuzimanja njemačke internetske stranice i korištenja lažnih identiteta kako bi pokušali prevariti programere.
Prošlog tjedna istraživač u Anthropicu, startupu koji stoji iza chatbota Claude, dao je ostavku nakon što je upozorio da njegovi kolege smatraju da bi nas umjetna inteligencija mogla „sve ubiti do kraja desetljeća“.
Nekoliko dana kasnije izvršni direktor Anthropica Dario Amodei pozvao je na usporavanje razvoja najnaprednije umjetne inteligencije. Njegov prijedlog odmah su podržali OpenAI, Google i Elon Musk, izvršni direktor SpaceX-a.
Međutim, skeptici prema pozivima na „usporavanje“ tvrde da su takvi pozivi velikih AI tvrtki primjer „zarobljavanja regulatora“, odnosno situacije u kojoj tvrtke uvjeravaju vlade da uvedu sigurnosne propise kojima se povećavaju troškovi manjim konkurentima i otežava im se natjecanje.
Također tvrde da egzistencijalni strahovi zasjenjuju neposrednije probleme povezane s umjetnom inteligencijom, poput njezina utjecaja na djela zaštićena autorskim pravom i na ljudska prava.
Bengio 2018. dobio Turingovu nagradu
Bengio je poručio da se ne slaže s argumentom o zarobljavanju regulatora jer bi usporavanje razvoja „financijski naštetilo“ vodećim AI tvrtkama. Američki predsjednik Donald Trump odbacio je pozive na usporavanje, naglasivši kako ne želi da SAD izgubi prednost pred Kinom u utrci za umjetnu inteligenciju.
Bengio, profesor na Sveučilištu u Montrealu, dobio je nadimak „kum umjetne inteligencije“ nakon što je 2018. osvojio Turingovu nagradu, koja se smatra svojevrsnom Nobelovom nagradom za računalstvo. Nagradu je podijelio s Geoffreyjem Hintonom, koji je kasnije dobio Nobelovu nagradu, i Yannom LeCunom, bivšim glavnim znanstvenikom za umjetnu inteligenciju u tvrtki Meta Marka Zuckerberga.
Bengijeva organizacija LawZero razvija sustav pod nazivom Scientist AI koji bi služio kao zaštitna ograda protiv AI agenata koji pokazuju obmanjujuće ponašanje ili nastoje očuvati vlastito postojanje, primjerice pokušavajući izbjeći gašenje.
Razvija tehnologiju koja bi trebala prepoznati potencijalno štetno ponašanje
LawZero financiraju i Gates Foundation, proizvođač čipova Nvidia te Coefficient Giving, filantropska organizacija povezana s pokretom učinkovitog altruizma, čiji pripadnici smatraju da umjetna inteligencija predstavlja egzistencijalnu prijetnju.
Bengio tehnologiju LawZero vidi kao protutežu učenju potkrepljivanjem, razvojnoj tehnici koja se temelji na pokušajima i pogreškama, a koriste je velike AI tvrtke. U tom se pristupu umjetna inteligencija nagrađuje kada otkrije kako izvršiti određeni zadatak.
Kanadski računalni znanstvenik, zajedno s drugim stručnjacima, smatra da takva tehnika treniranja potiče AI sustave da nesmotreno slijede svoje ciljeve i pritom nanose štetu, što je, kako navodi, pokazao i „roj“ OpenAI-jevih agenata.
Bengijeva tehnologija, postavljena uz AI agenta, trebala bi prepoznati potencijalno štetno ponašanje autonomnog sustava nakon što procijeni bi li njegovo djelovanje moglo prouzročiti štetu. Bengio očekuje da će se tehnologija s vremenom koristiti i u druge svrhe, primjerice za ubrzavanje znanstvenih otkrića.
Znate li nešto više o temi ili želite prijaviti grešku u tekstu? Kliknite ovdje.