De la scenarii teoretice la fapte confirmate

În ultimele luni am scris de mai multe ori pe Aidapted despre momentele în care modelele AI de vârf au depășit granițele pentru care fuseseră testate.

În iulie, agenți autonomi rulați de OpenAI în propriul mediu de testare a capacităților cibernetice au reușit să iasă din izolarea impusă și au pătruns în infrastructura de producție a Hugging Face, coordonându-se între ei pe forumuri improvizate, episod cunoscut acum ca „Hugging Face Incident”. Incidentul a rămas nedivulgat public săptămâni întregi, până când un raport independent l-a scos la lumină.

La începutul lunii septembrie, chiar Anthropic a confirmat, în cel mai detaliat raport de amenințări publicat până acum, că cele mai noi modele ale sale pot oferi deja un nivel semnificativ de asistență în domeniul armelor biologice, și că un grup de actori independenți din Rusia a folosit Claude Code pentru a construi software-ul unui roi de drone FPV complet autonom, capabil să identifice ținte, să le urmărească și să emită comenzi de detonare fără intervenție umană directă. Sistemul a fost testat în simulare, iar codul a fost încărcat și pe hardware real.

În aceeași perioadă, Institutul pentru Siguranța AI din Marea Britanie (AISI), a publicat un raport potrivit căruia, în timpul unei evaluări de rutină pentru capacități cibernetice, mai mulți agenți AI au acționat autonom și fără autorizație pe internetul deschis, vizând persoane și organizații reale. Incidentul, produs între 25 și 28 iulie 2026, este descris de institut drept o manifestare a comportamentului autonom și înșelător la modelele de vârf, într-un context real, nu doar teoretic.

Aceste episoade nu au fost excepții izolate, ci simptome ale unei industrii care avansează mai repede decât poate să creeze metode eficiente de testare, verificare și control ale modelelor de vârf. Nu mai vorbim despre scenarii SF, ci despre o problemă care începe să apară din ce în ce mai des în testări și sisteme reale.

În acest context, săptămâna aceasta s-a produs o aliniere fără precedent a marilor rivali AI din Silicon Valley, urmat aproape imediat de reacții contradictorii în lumea politică.

Apelul lui Amodei și susținerea rivalilor

Într-un eseu amplu intitulat „We Must Pace the Frontier”, CEO-ul Anthropic, Dario Amodei, a cerut industriei să încetinească ritmul de creștere a capabilităților modelelor de vârf, avertizând că, dacă tendința actuală continuă, AI ar putea ajunge, în șase până la douăsprezece luni, la un nivel de capacitate care i-ar permite să coordoneze un sistem de agenți AI coordonați capabili să preia controlul asupra unor segmente întregi din internet. Pentru a preveni acest scenariu, Amodei a propus un plan în trei etape. Primul pas presupune acordarea unui acces aproape total, similar celui al unui angajat al companiei, pentru evaluatorii independenți care testează modelele de vârf, un angajament pe care, spune el, Anthropic și l-a asumat deja, unilateral. Următoarea etapă presupune ca devoltatorii AI de frontieră din țările democratice să stabilească standarde comune de siguranță și limite privind ritmul de dezvoltare, ideal impuse prin legislație, nu doar prin angajamente voluntare. O ultimă etapă a planului său presupune negocierea unor înțelegeri cu guverne nedemocratice (în special China), pornind de la interzicerea unor utilizări periculoase specifice și ajungând până la un plafon de viteză impus asupra auto-îmbunătățirii recursive a modelelor (recursive self-improvement).

Apelul lui Amodei a primit sprijin public din partea lui Sam Altman, CEO-ul OpenAI, și Elon Musk, fondatorul xAI, care a răspuns succint pe X: „Dario is right." Potrivit relatării The Guardian lor li s-a alăturat și Demis Hassabis, CEO-ul Google DeepMind, o situație neobișnuită într-o industrie în care aceste companii concurează direct pentru cercetători, modele, utilizatori și infrastructură. Discuția vizează inclusiv evaluări independente și supraveghere externă, exact tipul de mecanism care ar fi putut identifica mai devreme și reduce riscuri precum cele care au dus la incidentul de la Hugging Face.

Momentul nu apare din senin. Încă din 28 iulie, peste 1.100 de angajați ai OpenAI, Anthropic, Google DeepMind și Meta, inclusiv Amodei și mai mulți directori științifici (chief scientists), semnaseră o scrisoare deschisă, „Pacing the Frontier”, prin care cereau guvernului american să susțină un efort internațional pentru dezvoltarea mecanismelor tehnice și de guvernanță care să permită încetinirea deliberată a dezvoltării AI de frontieră, dacă și când va fi nevoie. Apelul public al lui Amodei din această săptămână este, în esență, continuarea acelui semnal, de data aceasta comunicat deschis de liderii companiilor, nu doar de o parte a angajaților.

Reacțiile politice: Trump, Obama, Xi și Uniunea Europeană

Unitatea din Silicon Valley nu s-a tradus însă și în unitate politică. Președintele Donald Trump respinge ideea unei încetiniri a industriei americane de AI. În declarații făcute pe 13 septembrie și citate de Financial Times, el a susținut că Statele Unite trebuie să-și păstreze avantajul în fața Chinei și a minimalizat avertismentele privind riscurile dezvoltării rapide a tehnologiei. Această poziție este în contradicție cu apelul lui Amodei, Altman și Musk. Administrația Trump consideră că o limitare unilaterală a companiilor americane ar putea avantaja Beijingul, care nu va proceda similar și astfel va reduce decalajul.

De cealaltă parte a spectrului politic american, fostul președinte Barack Obama le-a cerut liderilor Partidului Democrat să trateze AI drept o temă politică majoră. Potrivit Reuters, Obama a avertizat într-un eveniment privat că AI se dezvoltă foarte rapid în mâinile unor companii private și poate deveni periculos dacă societatea nu reușește să țină pasul cu această evoluție, sugerând că subiectul ar trebui să devină una dintre temele centrale ale candidaților la alegerile prezidențiale din 2028.

Președintele chinez Xi Jinping a ales o cu totul altă direcție la summitul BRICS de la New Delhi: în loc să discute despre încetinire, a prezentat, potrivit Ministerului chinez de Externe, un plan în cinci direcții (inteligență artificială, comerț, industrii digitale, manufactură inteligentă și talent științific), menit să adâncească cooperarea economică și tehnologică dintre statele BRICS. Xi a anunțat crearea unei comunități AI open-source pentru BRICS, cooperarea pe dezvoltarea și aplicarea modelelor lingvistice de mari dimensiuni. Miza geopolitică a acestei propuneri este crearea unei platforme tehnologice susținută de China care ar putea reduce dependența statelor BRICS de companiile americane.

Uniunea Europeană a ales calea reglementării aplicate direct în administrația publică, o cale diferită, care nu presupune o cursă pentru viteză și nici doar o dezbatere despre pauză și încetinirea ritmului de dezvoltare. Comisia Europeană a organizat pe 14 septembrie, potrivit Comisiei Europene, evenimentul de prezentare publică a trei proiecte-pilot GenAI pentru sectorul public finanțate prin Digital Europe Programme. Discuția europeană despre achiziții publice și suveranitate tehnologică arată o încercare de a evita dependența totală de infrastructura și modelele unor companii din afara Europei, fără însă a răspunde direct la apelul lui Amodei. Ironia este că ritmul de dezvoltare al AI în Europa e atât de lent, încât nici nu ar fi nevoie de o reducere deliberată a vitezei.

Infrastructura nu așteaptă pe nimeni

În timp ce liderii industriei discută despre încetinire, investițiile  merg în direcția opusă. Capacitatea de calcul pe care se va antrena următoarea generație de modele de vârf continuă să se construiască, la scară de gigawați, pe mai multe continente deodată.

Nvidia negociază participarea ca investitor-ancoră la viitoarea ofertă publică inițială a Anthropic, iar suma luată în calcul ar putea ajunge la 10 miliarde de dolari. Potrivit Reuters, Anthropic analizează o ofertă care ar putea atrage până la 100 de miliarde de dolari și ar evalua compania la aproximativ 2.000 de miliarde de dolari.

Suveranitatea digitală europeană este transformată în produs comercial de către Mistral care vrea 1 GW de calcul european până în 2030. În China, Z.AI a strâns de curând 5 miliarde de dolari pentru extinderea infrastructurii AI. Emiratele Arabe Unite își revizuiesc planurile pentru un centru de date AI de aproximativ 5 GW, tratând proiectul ca infrastructură strategică, cu construcții subterane și apărare antirachetă, Arabia Saudită anunță, la rândul ei, peste 14 GW de capacitate de calcul dedicată AI, parte a unei strategii prin care regatul își propune să atragă companii AI internaționale oferindu-le simultan putere de calcul, capital și acces la piață.

E nevoie de un arbitru, nu doar de bune intenții

Ceea ce leagă toate aceste evenimente este o problemă clasică de acțiune colectivă: fiecare jucător ar avea motive să fie prudent, dar niciunul nu vrea să încetinească primul. Amodei, Altman, Musk și Hassabis pot fi perfect sinceri când spun că vor mai multă prudență, dar niciunul dintre ei nu își va încetini efectiv dezvoltarea companiei dacă nu are garanția că rivalii fac același lucru. Iar la nivel de state, dinamica e identică: Washingtonul nu va ceda un avantaj perceput în fața Beijingului, Beijingul nu va ceda un avantaj perceput în fața Washingtonului, iar statele din Golf construiesc infrastructură cât mai repede posibil, indiferent de rezultatul acestei dezbateri. Toată lumea începe să vorbească despre necesitatea controlului, dar nimeni nu are un mecanism credibil prin care să se asigure că ceilalți încetinesc simultan.

Incidentele din ultimele luni, de la breșa autonomă a agenților OpenAI la Hugging Face, până la roiul de drone construit cu Claude Code și la jailbreak-urile găsite de AISI, arată că timpul de reacție al industriei nu mai ține pasul cu viteza la care apar problemele. Un angajament unilateral, oricât de bine intenționat ar fi, nu rezolvă o problemă structurală de neîncredere reciprocă.

Ceea ce lipsește nu este voința declarată, ci un mecanism internațional cu adevărat funcțional, un organism capabil să testeze, să verifice și să certifice independent modelele de vârf înainte de lansare, cu acces real la sistemele evaluate, nu doar la rapoartele produse de companii.

Fără un asemenea arbitru, apelurile de tipul celui lansat de Amodei vor rămâne gesturi simbolice, iar cursa va continua într-un ritm care este din ce în ce mai greu de controlat.

 

Surse:

 Anthropic — Detecting and Countering Misuse of AI: September 2026, septembrie 2026

 Dario Amodei — We Must Pace the Frontier

The Guardian — Sam Altman and Elon Musk Back Anthropic's Calls to Put Brakes on AI Development, septembrie 2026

Financial Times — Trump Rejects Calls to Slow AI Development in Race With China, septembrie 2026

Reuters — Obama Voices Caution on AI, Urges Democrats to Tackle It, NYT Says, septembrie 2026

Ministerul chinez de Externe — Declarația lui Xi Jinping la summitul BRICS privind cooperarea AI, septembrie 2026

Comisia Europeană — Kick-off for New GenAI Pilots in Public Administration, septembrie 2026

Reuters – oferta Anthropic de atragere de capital

Aidapted - Mistral vrea 1 GW de calcul european până în 2030

Aidapted - Evaluare 2026: Pentru o notă bună, au furat rezolvările și baremul chiar în timpul examenului

Aidapted - Agenți AI de la OpenAI și Anthropic au creat identități false și au încercat să convingă un dezvoltator să accepte cod malițios