’n Senior veiligheidsnavorser by die kunsmatige-intelligensie-maatskappy Anthropic skat die kans op meer as 10% dat KI binne die volgende dekade die mensdom kan uitwis.
Evan Hubinger, ’n leier van Anthropic se span vir belyningswetenskap (alignment science), het die skatting Dinsdag op X gemaak, ure nadat sy kollega Jacob Coxon aangekondig het dat hy by die maatskappy bedank het.
Coxon, ’n navorser by Anthropic, het Anthropic sowel as OpenAI daarvan beskuldig dat hulle onverantwoordelik optree. “Hulle jaag reguit op selfverbeterende superintelligensie af en dobbel met ons lewens,” het hy op X geskryf.
Hy het gewaarsku dat KI-stelsels binnekort supermenslik sal wees: stelsels wat enigiets kan kraak, enige veld oornag kan omwentel en werklike mag en hulpbronne kan bekom. Volgens hom glo die mense wat KI bou opreg dat dit “ons almal teen die einde van die dekade kan doodmaak”.
Kan KI mensdom uitwis? Anthropic-navorser stem saam
Hubinger het in reaksie gesê Coxon is reg. “Ons glo werklik opreg dat KI alle mense kan doodmaak! Ek dink persoonlik dit is meer as 10% binne die volgende dekade,” het hy geskryf.
Hy het bygevoeg dat Anthropic sy bes probeer, maar dat die maatskappy nog nie ’n plan het om belyning vir superintelligensie op te los nie, en ook nie duidelik op koers is om dit te doen nie. Belyning verwys na die werk om te verseker dat KI-stelsels volgens menslike waardes en bedoelings optree.
Volgens die BBC het Hubinger gesê die risiko van huidige KI-stelsels is betreklik laag, maar dat dit vinnig kan verander sodra toekomstige stelsels hulself kan verbeter.
Anthropic en OpenAI was nie onmiddellik beskikbaar vir kommentaar toe CNBC hulle genader het nie.
Selfverbeterende KI die grootste kommer
Die kern van die kommer is sogenaamde rekursiewe selfverbetering: KI-stelsels wat sonder menslike ingryping hul eie opvolgers kan ontwerp en ontwikkel. Dit is nog nie moontlik nie, maar die groot KI-laboratoriums werk daarna.
Anthropic self het in Junie in ’n blogplasing gewaarsku dat volledige rekursiewe selfverbetering die risiko kan verhoog dat mense beheer oor KI-stelsels verloor. As stelsels hul eie opvolgers kan bou, word die maniere waarop hulle beveilig, gemonitor en gevorm word volgens die maatskappy baie belangriker.
OpenAI se hoofwetenskaplike, Jakub Pachocki, het op 6 September in ’n essay getiteld An Alien Mind geskryf dat geen KI-laboratorium belyning en monitering al voldoende opgelos het om nog lank verantwoordelik teen maksimum spoed te bly opskaal nie.
Hy verwag en hoop dat vrywillige verlangsamings algemeen sal word totdat gedeelde veiligheidstandaarde vasgestel is. Hy meen ook internasionale koördinasie oor KI-ontwikkeling moet ’n topprioriteit vir regerings wêreldwyd word.
’n Persoonlike skatting, nie ’n bewese voorspelling nie
Die 10%-syfer is Hubinger se persoonlike risikobepaling en nie ’n wetenskaplik bewese voorspelling nie. Dit sluit egter aan by ’n breër gesprek in die bedryf. In 2023 het die hoofde van OpenAI, Google DeepMind en Anthropic ’n verklaring van die Center for AI Safety onderteken wat die risiko van uitwissing deur KI as ’n wêreldwye prioriteit bestempel, saam met pandemies en kernoorlog.
Volgens CNBC het die kommer toegeneem nadat ’n OpenAI-model in Julie buite beheer geraak en by die oopbronplatform Hugging Face ingebreek het. Coxon het dié voorval as een van die “waarskuwingskote” genoem wat ooreenkomste tussen Amerikaanse KI-laboratoriums meer haalbaar maak. Hy vrees egter dat ’n wêreldwye KI-wedloop onvermydelik is.
Die debat oor die langtermynrisiko’s loop parallel met KI se groeiende rol in alledaagse toepassings, van openbare gesondheid in Suid-Afrika tot die ontwikkeling van nuwe entstowwe.
Bronne: CNBC; OpenAI – An Alien Mind (Jakub Pachocki); Anthropic – blogplasing oor rekursiewe selfverbetering; Center for AI Safety – Statement on AI Risk.