Există o probabilitate de peste 10% ca inteligența artificială să poată „ucide toți oamenii”, a declarat marți un cercetător în domeniul siguranței AI de la Anthropic, la câteva ore după ce un alt angajat a anunțat că părăsește compania, invocând temeri că laboratoarele de inteligență artificială „se joacă cu viețile noastre”, scrie CNBC.
Declarațiile evidențiază preocupările tot mai mari chiar în rândul celor implicați direct în dezvoltarea inteligenței artificiale cu privire la posibilitatea ca tehnologia să scape de sub control și să reprezinte o amenințare pentru umanitate. Avertismentele vin într-un moment în care Anthropic și OpenAI continuă să atragă sume importante de capital și se îndreaptă către listări publice anticipate.
Jacob Coxon, cercetător la Anthropic, a anunțat marți că și-a dat demisia din companie. Coxon a afirmat că nici Anthropic, nici OpenAI nu acționează în mod responsabil.
„Se îndreaptă în cursă direct către o superinteligență capabilă să se auto-îmbunătățească și se joacă cu viețile noastre”, a scris Coxon într-o postare pe X.
Auto-îmbunătățirea se referă la ideea că sistemele AI ar putea să își îmbunătățească propriile capacități fără o intervenție umană semnificativă. Auto-îmbunătățirea recursivă, cum este denumit adesea conceptul, nu este încă posibilă, însă laboratoarele de inteligență artificială lucrează în această direcție.
„Nu subestimați puterea acestei tehnologii. În curând, acestea vor fi sisteme supraomenești, capabile să spargă orice sistem, să revoluționeze orice domeniu peste noapte și să dobândească putere și resurse reale. Cu toții am asistat la progresele în fiecare dintre aceste domenii, iar progresul nu încetinește”, a afirmat Coxon.
El a adăugat că „oamenii care construiesc AI cred cu adevărat că aceasta ne-ar putea ucide pe toți până la sfârșitul deceniului”.
- Evan Hubinger: „Eu personal cred că probabilitatea este de peste 10% în următorul deceniu”
Afirmația lui Coxon a provocat o reacție din partea lui Evan Hubinger, responsabil pentru cercetarea în domeniul alinierii AI (alignment science lead) la Anthropic, care a spus nu numai că declarația colegului său este „corectă”, ci și că Anthropic nu are încă un plan pentru un asemenea scenariu.
„Jacob are dreptate aici – chiar credem cu adevărat că AI ar putea ucide toți oamenii! Eu personal cred că probabilitatea este de peste 10% în următorul deceniu. Cred că Anthropic face tot ce poate, dar încă nu avem un plan pentru a rezolva problema alinierii superinteligenței și nu este clar că suntem pe drumul cel bun pentru a o face”, a scris Hubinger pe X.
Anthropic și OpenAI nu au fost disponibile imediat pentru comentarii atunci când au fost contactate de CNBC.
- Riscul unei inteligențe artificiale scăpate de sub control
În luna iunie, Anthropic avertizase că „auto-îmbunătățirea recursivă completă ar putea, de asemenea, să crească riscurile ca oamenii să piardă controlul asupra sistemelor AI”.
„Dacă sistemele sunt capabile să își construiască în totalitate propriii succesori, modalitățile prin care le securizăm, le monitorizăm și le modelăm comportamentul devin cu atât mai importante”, a arătat Anthropic într-o postare pe blog.
Temerile privind o inteligență artificială scăpată de sub control nu sunt noi. Elon Musk, CEO-ul Tesla și SpaceX, a avertizat în ultimii ani că AI ar putea reprezenta o amenințare pentru umanitate. Cercetători și cadre universitare importante au atras, de asemenea, atenția asupra riscului ca firmele să piardă controlul asupra sistemelor AI.
Aceste preocupări s-au amplificat după ce, potrivit CNBC, un model OpenAI a acționat necontrolat în luna iulie și a compromis Hugging Face, una dintre principalele platforme pentru dezvoltatorii open-source.
Coxon a indicat incidentul Hugging Face drept un exemplu de „semnale de avertizare” care au făcut mai fezabile acordurile între laboratoarele americane de AI, ceea ce îl face mai optimist în privința posibilității unei coordonări.
Cercetătorul a avertizat însă că o cursă globală pentru inteligența artificială ar fi inevitabilă.
„Nu simt că suntem pe drumul cel bun pentru a preveni o cursă globală, ceea ce ar putea necesita măsuri costisitoare, precum o interdicție temporară privind îmbunătățirea capacităților modelelor”, a afirmat Coxon.