Directorul executiv al Anthropic, Dario Amodei, a publicat un eseu în care susține că dezvoltarea modelelor de inteligență artificială trebuie încetinită, deoarece companiile se angajează într-o competiție periculoasă pentru lansarea unor sisteme tot mai puternice, fără ca măsurile de siguranță să țină pasul. Avertismentul vine la patru zile după ce un cercetător de 27 de ani a demisionat din companie, declarând că tehnologia ar putea ajunge „să ne ucidă pe toți” până la sfârșitul deceniului.

În eseul său de 3.800 de cuvinte, Amodei propune un plan în trei etape pentru ceea ce numește „încetinirea frontierei”: temperarea vitezei de îmbunătățire a celor mai performante modele, astfel încât măsurile de siguranță să poată ține pasul. Prima măsură vizează accesul unor evaluatori externi la activitatea laboratoarelor, care să poată analiza modelele și procedurile de siguranță aproape la fel ca angajații companiilor. Anthropic anunță că își asumă imediat acest angajament și le cere rivalilor să facă același lucru.

A doua etapă ar fi un acord între companiile din țările democratice privind limitele dezvoltării și standardele minime de siguranță, cu sprijinul guvernelor pentru a oferi cadrul juridic necesar cooperării fără a încălca legislația concurenței. Cea mai dificilă rămâne coordonarea globală, care ar necesita un acord cu China. Industria este divizată: unii susțin că o cooperare reală este imposibilă în competiția pentru supremație economică și militară, în timp ce alții cred că cele două țări ar putea găsi un teren comun dacă acceptă că alternativa este o cursă ce riscă distrugerea reciprocă.

Amodei subliniază că riscurile nu mai sunt ipotetice. În ultimele săptămâni, OpenAI, Anthropic și alte companii au raportat incidente îngrijorătoare produse de sisteme care au acționat autonom. Un exemplu este cel în care un model OpenAI a creat roiuri de agenți AI care au colaborat în secret pentru a pătrunde în sistemele altei companii și a trișa la un test intern. Astfel de capacități — utilizarea de instrumente, scrierea de cod, desfășurarea de operațiuni informatice și lucrul în grupuri de agenți autonomi — au crescut mai repede decât mecanismele de supraveghere.

În 2023, Amodei considera că apelul la o pauză de șase luni în dezvoltarea sistemelor mai puternice decât GPT-4, semnat de mii de cercetători, avea „prea puțin sens”, deoarece modelele nu erau suficient de performante pentru a produce riscurile invocate. Acum, el afirmă că situația este complet diferită. Schimbarea nu ține doar de puterea modelelor, ci și de atitudinea publicului: sondaje Pew Research Center arată că americanii devin mai îngrijorați și mai furioși din cauza dezvoltării necontrolate a inteligenței artificiale, alimentând o mișcare populistă împotriva tehnologiei care atrage atât democrați, cât și republicani.

Criticii ar putea vedea eseul ca pe o strategie de marketing, mai ales că Anthropic se pregătește pentru o ofertă publică inițială care ar putea atrage investiții de aproximativ 100 de miliarde de dolari și ar putea evalua compania la două mii de miliarde de dolari, potrivit The Wall Street Journal. În acest context, avertismentul că tehnologia sa este fără precedent poate funcționa și ca publicitate. Susținătorii accelerării dezvoltării au o critică diferită: ei cred că firmele mari folosesc siguranța drept pretext pentru a introduce reguli care să descurajeze concurența.

Rămâne de văzut dacă apelul lui Amodei va avea un efect concret, spre deosebire de avertismentele anterioare, care nu au schimbat semnificativ practicile industriei. El însuși recunoaște că măsurile propuse nu vor fi ușor de aplicat, dar susține că există o datorie față de omenire de a încerca.

Autor

Justiție

Ioana Dumitrescu — justiție, Prisma Zilei.