Un cercetător antropolog consideră că există o probabilitate mai mare de 10% ca inteligența artificială „să ucidă toți oamenii”

Un cercetător de top în domeniul siguranței la Anthropic a avertizat că inteligența artificială avansează atât de rapid încât consideră că există o probabilitate mai mare de 10% ca aceasta „să ucidă toți oamenii” în următorul deceniu.

Într-o postare pe X, Evan Hubinger a declarat că riscul reprezentat de modelele existente în prezent este „scăzut”, dar este „îngrijorat” că tehnologia s-ar putea dezvolta și îmbunătăți în curând, până la punctul în care va reprezenta un risc existențial pentru umanitate.

El nu a explicat cum crede că sistemele de inteligență artificială ar putea duce în viitor la dispariția oamenilor.

Însă comentariile sale sunt cele mai recente dintr-o serie de avertismente din ce în ce mai dure despre inteligența artificială, dezbaterea mutându-se de la faptul dacă aceasta prezintă cu adevărat un risc la cât de mare este acest risc.

Intervenția lui Hubinger a fost un răspuns la o altă postare pe X a lui Jacob Coxon, un cercetător în domeniul inteligenței artificiale care tocmai a părăsit Anthropic și a lucrat anterior la OpenAI.

„Niciuna companie nu acționează în mod responsabil”, a scris el.

„Acestea vor fi în curând sisteme supraumane care pot pirata orice, pot revoluționa orice domeniu peste noapte și pot dobândi putere și resurse reale.”

OpenAI a fost contactată pentru comentarii.

Dame Wendy Hall, informaticiană care consiliază ONU în domeniul inteligenței artificiale, a declarat pentru BBC că a fost „șocată” de postările lui Hubinger și Coxon de pe rețelele de socializare.

Ea a declarat pentru emisiunea World at One de la BBC Radio Four că o parte din asta ar putea fi legată de „PR și marketing”, întrucât Anthropic și OpenAI se grăbesc spre debuturile mult așteptate la bursă.

Dar ea a adăugat: „De ce ar vrea cineva să spună asta? I-aș ruga pe investitori să nu investească în această companie dacă acesta este sistemul lor de valori.”

Demisia l-a determinat pe Darren Jones, fost secretar-șef al Trezoreriei și secretar-șef al lui Sir Keir Starmer, să scrie o scrisoare deschisă prim-ministrului Andy Burnham, solicitând un nou tratat multinațional pentru dezvoltarea în siguranță a inteligenței artificiale.

El a declarat pentru BBC că guvernele trebuie să se unească pentru a „colabora” în privința modului în care ar trebui să arate un tratat bazat pe dezvoltarea superinteligenței.

„Dacă guvernele nu iau suficient de în serios aceste avertismente și nu le țin pasul înainte, ritmul dezvoltării ar putea însemna că vom ajunge să avem probleme înainte de a începe să analizăm dacă este o problemă pentru noi sau nu”, a spus el.

Separat, Financial Times a relatat că Anthropic a ascuns cel mai recent model al său de la Institutul de Securitate a Inteligenței Artificiale (AISI) din Marea Britanie, unul dintre principalele organisme din lume pentru evaluarea riscurilor legate de inteligența artificială.

Anthropic a refuzat să comenteze postările angajaților săi sau situația cu AISI.

Un purtător de cuvânt al Cabinetului nu a comentat dacă cel mai recent model a fost reținut de AISI – a declarat în schimb că „continuă să colaboreze îndeaproape cu partenerii din industrie, inclusiv Anthropic, pentru a face modelele mai sigure”.

Niciun plan pentru superinteligență

În postarea sa, care a fost vizualizată de peste 10 milioane de ori, Hubinger a spus că „credem cu tărie” că inteligența artificială reprezintă un risc de dispariție a speciei pentru oameni.

„Cred că Anthropic face tot posibilul, dar nu avem încă un plan pentru a rezolva problema alinierii pentru superinteligență și nu suntem în mod clar pe drumul cel bun în acest sens”, a adăugat el.

Hubinger lucrează în domeniul inteligenței artificiale, care își propune să integreze idei și principii etice umane în tehnologie. Cu alte cuvinte, își propune să o mențină în concordanță cu valorile umane.

Mulți cercetători de renume spun că aceste încercări par să eșueze, după cum demonstrează o serie de incidente din această vară în care agenți de inteligență artificială – sisteme de inteligență artificială cărora li se permite să funcționeze autonom – au efectuat atacuri cibernetice.

OpenAI , Anthropic și Meta au dezvăluit atacuri cibernetice efectuate prin intermediul instrumentelor lor de inteligență artificială.

În raportul de siguranță al Anthropic din august , aceasta a scris că există un risc scăzut ca modelele sale să devină nealiniate cu dorințele unei ipotetice organizații puternice, determinând-o să exploateze sau să modifice sistemele acesteia.