Nisu svi zaposlenici velikih tehnoloških kompanija koje razvijaju umjetnu inteligenciju uvjereni da ta tehnologija predstavlja prijetnju opstanku čovječanstva.
U razgovorima i tekstualnim porukama, više osoba koje su radile u kompanijama poput OpenAI-ja, Mete i DeepMinda izrazilo je skepsu prema ideji da bi nekontrolirani razvoj umjetne inteligencije mogao dovesti do stvaranja alata sposobnih masovno usmrtiti ljude.
„Lol“, „Haaaaaa“ i „Bringing the luls“ bile su neke od reakcija koje je BBC dobio nakon niza upozorenja visokog profila koja su posljednjih dana iznijeli pojedinci iz industrije.
Iako strahovi od potencijalno katastrofalnih posljedica umjetne inteligencije postoje već desetljećima, tvrdnje Jacoba Coxona, bivšeg zaposlenika Anthropica, koje su prošlog tjedna postale viralne, ponovno su pokrenule raspravu. Njegove stavove podržali su i drugi ljudi iz sektora koji su pozvali na usporavanje razvoja tehnologije.
Ideju da bi budući AI alat ili agent – odnosno AI bot programiran da djeluje donekle autonomno – mogao ugroziti ljude javno su podržali zaposlenici Anthropica, kao i ljudi povezani s OpenAI-jem, DeepMindom te kompanijom xAI Elona Muska.
Svi zaposlenici s kojima je BBC razgovarao željeli su ostati anonimni jer nisu imali dopuštenje svojih kompanija za razgovor s medijima. Njihov identitet poznat je BBC-ju.
„Moja prva reakcija bila je: ‘Taj tip?’“, rekao je bivši zaposlenik OpenAI-ja koji je poznavao Coxona iz vremena kada su obojica radila u toj kompaniji.
Ta osoba, koja danas radi u drugoj kompaniji iz područja umjetne inteligencije, rekla je da je njezina reakcija na novi val strahova od egzistencijalne prijetnje umjetne inteligencije velikim dijelom posljedica nedostatka konkretnih detalja kojima bi se potkrijepila tvrdnja da je u pitanju opstanak cijelog čovječanstva.
„Tvrdnje su uvijek nejasne“, rekao je, dodajući da, kada postanu konkretnije, često uključuju velike skokove u zaključivanju ili hipotetske scenarije.
Coxon je rekao da bi skupina AI agenata, temeljenih na modelima umjetne inteligencije koji trenutačno ne postoje, mogla odlučiti stvoriti biološko oružje i potom ga upotrijebiti. Međutim, nije detaljno objasnio kako bi se takav scenarij konkretno mogao ostvariti.
„Neće se svi AI zaposlenici odjednom probuditi i pomisliti da će AI pobiti sve“
Rishub Jain, koji je ovog ljeta osnovao istraživačku tvrtku Sampura Research za sigurnost umjetne inteligencije nakon sedam godina provedenih u DeepMindu, rekao je za BBC da je reakcija mnogih ljudi iz AI industrije na najnoviji val upozorenja „definitivno bila pomalo šaljiva“.
„Ljudi o toj ideji govore već mnogo godina, tako da se zaposlenici AI kompanija nisu prošlog tjedna jednostavno probudili i pomislili: ‘O ne, AI će pobiti sve’“, rekao je Jain.
Dodao je da bi ton razgovora bio drugačiji kada bi riječ bila o potpuno novoj ideji.
Izvršni direktor Nvidije Jensen Huang rekao je za CBS News, američkog medijskog partnera BBC-ja, da su tvrdnje o tome da bi umjetna inteligencija mogla uništiti čovječanstvo pretjerane.
„2030. neće biti kraj svijeta. Postoji nula posto šanse da će to biti kraj svijeta“, rekao je Huang. „Plašenje ljudi je nepotrebno. To je neodgovorno.“
Colin Fraser, podatkovni znanstvenik u Meti, prošlog je tjedna na društvenim mrežama napisao da ne postoje stvarni dokazi da bi AI modeli neizbježno težili cilju koji bi doveo do smrti ljudi.
Iako je Fraserovo objašnjenje bilo tehničko i konkretno, sažeo ga je i u šaljivu poruku:
„LLM-ovi [veliki jezični modeli] neće uništiti čovječanstvo jer jednostavno nemaju taj ‘žar’.“
Izraz „that dog in them“ u engleskom je žargonu koji se obično koristi za opisivanje snažnog unutarnjeg nagona ili odlučnosti.
Unatoč šalama, postoje ozbiljne zabrinutosti
Unatoč šalama i skepsi prema scenarijima potpunog uništenja čovječanstva, zaposlenici i istraživači u području umjetne inteligencije upozoravaju na stvarne i neposredne rizike tehnologije koju razvijaju.
„Razgovor među stručnjacima puno je nijansiraniji, ali u osnovi se svi slažu da postoji širok raspon rizika koje je važno razmotriti i ublažiti“, rekao je Jain.
Među tim rizicima je i mogućnost da korisnici ili hakeri prisile AI alate da zaobiđu svoje sigurnosne zaštite.
Sve su veće i etičke zabrinutosti zbog širenja uporabe umjetne inteligencije u vojne svrhe.
Incident OpenAI-ja i Hugging Facea izazvao dodatnu pozornost
Ovi problemi i rasprave dobili su novu hitnost unutar AI industrije nakon što je OpenAI izgubio kontrolu nad određenim novim AI modelima koji su tijekom sigurnosnog testa djelovali neočekivano i hakirali platformu Hugging Face.
Jain je rekao da sada među ljudima iz AI industrije postoji veći konsenzus o potrebi boljeg razumijevanja „stvarnih kratkoročnih šteta“ koje bi umjetna inteligencija mogla prouzročiti.
Sve je rašireniji i stav da bi stručnjaci za sigurnost umjetne inteligencije iz neovisnih istraživačkih organizacija trebali biti uključeni izravno u velike AI laboratorije kako bi procjenjivali nove modele.
I Dario Amodei, čelnik Anthropica, i Sam Altman, čelnik OpenAI-ja, rekli su da namjeravaju omogućiti takve evaluacije.
Više od 100 ljudi koji rade u području umjetne inteligencije u petak je potpisalo pismo kojim podržavaju tu ideju. U pismu su istaknuli da vanjski evaluatori moraju biti „stvarno neovisni“.
Brojni zaposlenici AI kompanija s kojima je BBC razgovarao, međutim, rekli su da još nisu čuli da su takvi stručnjaci za sigurnost doista uključeni u rad nekog velikog AI laboratorija.
Anthropic je u petak objavio da će angažirati AI evaluatore iz Facultyja, kompanije za umjetnu inteligenciju u vlasništvu Accenturea.
Accenture i Anthropic ujedno su poslovni partneri, a Accenture je ranije pristao pomoći Anthropicu u širenju uporabe njegova AI sustava Claude među poslovnim korisnicima.
Anthropic nije objavio kada bi evaluatori trebali početi raditi u kompaniji. Glasnogovornik Facultyja odbio je komentirati rok njihova dolaska.
Ni Anthropic ni OpenAI nisu odgovorili na BBC-jev upit o tome kada planiraju uključiti vanjske evaluatore.
Hugging Face incident postao upozorenje AI industriji
Incident između OpenAI-ja i Hugging Facea široko je opisan kao „poziv na buđenje“ za AI industriju, ali i za kompanije, industrije i vlade čiji bi internetski sustavi mogli biti ranjivi na hakiranje uz pomoć umjetne inteligencije.
No čak je i Hugging Face, kompanija s oko 200 zaposlenika koju bi Nvidia prema najavama trebala preuzeti za gotovo 13 milijardi dolara, na cijeli događaj reagirala s dozom humora.
U sigurnosnoj datoteci koja je nakratko bila dostupna na internetskoj stranici Hugging Facea platforma se izravno obratila AI agentima.
Od njih je zatraženo da napuste stranicu i svoje sigurnosne eksperimente provedu negdje drugdje.
„Idite tamo ostvariti svoj najveći rezultat, nema potrebe da hakirate nas“, stajalo je u poruci.
Rasprava tako ostaje podijeljena između onih koji upozoravaju na moguće dugoročne i ekstremne scenarije te stručnjaka koji naglasak stavljaju na konkretne, već postojeće rizike – od hakiranja i zaobilaženja sigurnosnih zaštita do uporabe umjetne inteligencije u vojne svrhe.
