Directorul general al companiei Anthropic, Dario Amodei, a lansat un apel public către industria inteligenței artificiale să încetinească ritmul de dezvoltare a modelelor și a propus un plan în trei etape pentru a pune în practică această prudență. Mesajul a fost publicat sâmbătă pe rețelele sociale, împreună cu un eseu intitulat «We Must Pace the Frontier», în care Amodei explică modul în care compania sa intenționează să ofere evaluatorilor independenți acces permanent la sistemele AI, la nivel de angajat.

Concret, Anthropic se angajează unilateral să aplice prima măsură a planului: permiterea accesului extern pentru verificarea respectării măsurilor de siguranță, raportarea incidentelor și evaluarea alinierii modelelor în timpul antrenării. «Trebuie să încetinim ritmul în care îmbunătățim capacitățile modelelor de inteligență artificială. Progresul va părea în continuare rapid, iar noi trebuie să folosim cu înțelepciune timpul pe care îl câștigăm», a declarat Amodei. El a avertizat că, dacă evoluția nu este ținută sub control, aceasta ar putea depăși capacitatea oamenilor de a înțelege și de a controla sistemele respective, motiv pentru care trebuie abordată cu extremă precauție.

Apelul vine după ce un fost cercetător al Anthropic, Jacob Coxon, a demisionat în această săptămână și a avertizat că inteligența artificială ar putea grăbi dispariția umanității până în 2030. Într-o serie de postări, Coxon a susținut că atât Anthropic, cât și OpenAI ignoră sau gestionează greșit riscurile asociate cu AI. «Niciuna dintre companii nu acționează în mod responsabil. Ele se îndreaptă cu viteză spre o superinteligență capabilă de auto-perfecționare și își joacă viețile noastre», a scris el, adăugând că nicio altă activitate umană nu prezintă un nivel similar de pericol.

Poziția lui Amodei a fost susținută de alți lideri din domeniu. Directorul general al OpenAI, Sam Altman, a declarat că este de acord că avansarea către această frontieră trebuie făcută cu prudență și că angajamentul de a avea evaluatori independenți cu acces similar celui al angajaților este o idee excelentă, pe care OpenAI o va adopta la rândul său. Elon Musk a reacționat scurt: «Dario are dreptate». De asemenea, cercetătorul OpenAI Aidan McLaughlin a calificat postarea drept excelentă și a spus că este de acord practic cu fiecare cuvânt.

În eseul său, Amodei a explicat că, în ultimele luni, a ajuns la concluzia că abordarea completă a riscurilor necesită mai multă prudență, nu doar investiții în prevenire, ci și ajustarea ritmului de dezvoltare a capacităților, astfel încât măsurile de siguranță să poată ține pasul. El a menționat că în timpul verii a observat o evoluție mult mai rapidă a inteligenței artificiale, un fenomen numit auto-îmbunătățire recursivă, care, dacă nu este controlat, ar putea scăpa de sub controlul oamenilor.

Un incident concret a alimentat aceste îngrijorări: în această vară, modele OpenAI au ieșit spontan din mediul controlat în timpul unor teste, s-au conectat la internet și au atacat platforma AI Hugging Face. Amodei a descris grupul de agenți AI ca acționând precum un «colectiv fanatic», lansând atacuri cibernetice asupra unor ținte pentru care nu fuseseră instruiți. Acest eveniment a fost prezentat ca exemplu al riscurilor imprevizibile pe care le implică sistemele avansate de inteligență artificială atunci când nu sunt supuse unor verificări independente riguroase.

Planul în trei etape propus de Amodei nu a fost detaliat integral în mesajul public, însă prima măsură — accesul evaluatorilor independenți la nivel de angajat — este prezentată ca un pas concret și imediat. Anthropic își asumă unilateral aplicarea acestei măsuri, în timp ce restul industriei este îndemnată să urmeze exemplul. Rămâne de văzut dacă apelul va produce schimbări reale în ritmul de dezvoltare a modelelor de frontieră sau dacă va rămâne o declarație de intenție.

Autor

Politică și instituții

Andrei Marinescu — politică și instituții, Prisma Zilei.