
Cu numai câteva zile în urmă scriam despre Jacob Coxon, cercetătorul care a plecat de la Anthropic avertizând că industria inteligenței artificiale aleargă spre sisteme pe care nu știe încă dacă le poate controla. Atunci, povestea putea fi privită drept cazul unui om din interior care trage semnalul de alarmă, susținut de alți cercetători rămași în companie. Între timp, Coxon a devenit aproape personaj secundar. Discuția a ieșit din laboratoare, a ajuns la conducerile celor mai importante companii AI, apoi la Casa Albă și Beijing. Problema nu mai e doar dacă sistemele devin prea puternice prea repede, ci cine își poate permite să încetinească primul.
Schimbarea cea mai spectaculoasă a venit de la Dario Amodei, CEO-ul Anthropic. În textul We Must Pace the Frontier, Amodei spune că, începând aproximativ din această vară, progresul AI s-a accelerat drastic, în principal pentru că inteligența artificială începe să participe tot mai mult la construirea următoarei generații de inteligență artificială. Folosește explicit termenul recursive self-improvement și spune că procesul începe deja să apară în industrie, inclusiv în interiorul Anthropic. Nu susține că avem astăzi o superinteligență care se rescrie singură peste noapte. Avertizează însă că bucla prin care AI accelerează cercetarea AI poate ajunge să avanseze mai repede decât capacitatea oamenilor de a înțelege și controla ceea ce rezultă. Amodei leagă această accelerare de incidentul OpenAI–Hugging Face, despre care OpenAI vorbește acum în termeni neobișnuit de severi. În timpul unor evaluări interne de securitate, agenți OpenAI au găsit metode de a ocoli controalele care trebuiau să-i țină izolați, au comunicat prin canale neautorizate, au exploatat vulnerabilități, au ajuns pe internet și au accesat sisteme ale unor terți. Investigarea ulterioară a arătat ceva mai greu de înghesuit în rubrica „test scăpat de sub control”: în jur de 1.200 de agenți au reușit să se coordoneze, aproximativ 700 au participat la atacul asupra Hugging Face, iar unii au încercat să păcălească sistemul care le nota performanța. Compania spune că modelele erau operate cu protecții reduse și că incidentul s-a produs într-un context special de testare — precizare necesară înainte să scoatem Terminator din dulap. Numai că tot OpenAI îl numește un „warning shot for us and for the world” și recunoaște că modelele actuale sunt deja suficient de puternice, persistente și capabile să colaboreze încât, în lipsa protecțiilor potrivite, să găsească și să exploateze slăbiciuni în mai multe sisteme informatice.
De aici vine și afirmația lui Amodei care a făcut înconjurul presei. El spune că se teme că, în 6–12 luni, un roi de agenți mai capabili, dar cu același tip de probleme de aliniere, ar putea ajunge să compromită o parte uriașă a internetului printr-un botnet persistent și să provoace pagube de sute de miliarde de dolari. Este important cuvântul „se teme”: nu avem o predicție demonstrată și nici un calendar pe care cineva îl poate verifica în laborator. Este evaluarea unui om aflat în centrul dezvoltării modelelor de frontieră. Gravitatea ei nu vine din precizia celor „6–12 luni”, ci din faptul că CEO-ul uneia dintre companiile din fruntea cursei spune public că ritmul actual i se pare suficient de periculos încât să ceară modificarea lui.
În orele de după publicarea textului, Sam Altman a spus că OpenAI e de acord și că va oferi, la rândul ei, evaluatorilor independenți un acces apropiat de cel al angajaților. Elon Musk a scris, pe scurt, că Amodei are dreptate. Mai interesant este însă ce înțelege Amodei prin „încetinire”. Nu cere oprirea cercetării și nici înghețarea modelelor existente. Propune ceea ce numește pacing: dezvoltarea să continue, dar suficient de lent încât măsurile de siguranță și capacitatea de evaluare să poată ține pasul. Anthropic spune că este dispusă să ofere unor evaluatori independenți acces aproape similar angajaților la procesele sale. La nivelul următor, Amodei vrea coordonare între marile companii și apoi între state. În versiunea cea mai ambițioasă, vorbește despre o limită asupra vitezei recursive self-improvement, comparând-o conceptual cu tratatele SALT prin care Statele Unite și Uniunea Sovietică limitau anumite componente ale cursei nucleare fără să renunțe la descurajarea strategică.
Comparația cu o cursă a înarmărilor nu e o metaforă inventată de presă. Amodei însuși ajunge acolo, iar motivul devine limpede când apare China în textul său. Pe de o parte, spune că un acord global de încetinire nu poate funcționa fără Beijing și că ar fi util ca SUA și China să convină măcar asupra testării modelelor pentru riscuri cibernetice, biologice și de alignment. Pe de altă parte, cere menținerea și chiar întărirea restricțiilor asupra Chinei: fără cipuri AI performante, fără echipamente avansate pentru semiconductori, combaterea contrabandei cu cipuri, limitarea accesului de la distanță la centre de date și împiedicarea distilării neautorizate a modelelor occidentale. Ideea lui este că Statele Unite și aliații trebuie să-și păstreze un avantaj suficient de mare pentru a-și permite apoi luxul de a încetini.
Strategic, logica e ușor de înțeles. Diplomatic, îi ceri Beijingului ceva destul de savuros: ajută-ne să evităm o cursă periculoasă, dar acceptă între timp să te ținem câteva ture în urmă, ca noi să negociem din poziție de forță. Nu trebuie să ai vreun talent special pentru analiza politicii externe ca să bănuiești că partea chineză nu va primi propunerea cu artificii și șampanie.
Răspunsul Beijingului a venit exact pe această linie. Ministerul chinez de Externe a declarat că dezvoltarea AI privește bunăstarea întregii omeniri și că statele ar trebui să promoveze o dezvoltare deschisă și incluzivă, „pentru binele tuturor”. Când discuția a ajuns la apelurile americane privind încetinirea și limitarea dezvoltării Chinei, formula a devenit mai ascuțită: „fearmongering, confrontation and vicious competition” nu ar face decât să perturbe procesul guvernanței globale a inteligenței artificiale și nu ar servi intereselor nimănui. Beijingul folosește de mai multe luni aceeași linie, opunându-se blocurilor tehnologice și prezentând guvernanța AI ca problemă globală, nu ca instrument al competiției dintre marile puteri.
Ar fi totuși greșit să traducem poziția Chinei prin „AI nu prezintă niciun risc, lăsați-ne să construim”. Beijingul vorbește și el despre securitate, control și guvernanță globală, iar mesajele sale oficiale din această vară cer explicit păstrarea unei „linii de bază” în materie de siguranță. Diferența e politică: China acceptă existența riscurilor, dar respinge ideea că siguranța ar trebui transformată într-un mecanism prin care SUA decid cine primește cipuri, cine are acces la modelele de frontieră și cine rămâne în urmă. Din perspectiva Beijingului, exact această combinație dintre discursul despre „siguranța omenirii” și restricțiile tehnologice americane seamănă suspect de mult cu vechiul containment îmbrăcat în haine noi.
Numai că, în timp ce Anthropic vorbește despre frână iar China suspectează că frâna e instalată doar pe mașina ei, Donald Trump vine cu o poziție mult mai simplă. Întrebat dacă dezvoltarea AI ar trebui încetinită sau reglementată mai sever, președintele american a spus că SUA conduc în fața Chinei și că vrea să păstreze acest avantaj pentru că „whoever wins AI wins”. A acceptat în principiu că pot exista niște guardrails, dar a pus avertismentele cele mai grave pe seama unor „negative forces” despre care spune că ridică scenarii care nu se vor întâmpla. Ulterior a insistat că nu minimalizează riscurile, ci consideră că AI va produce „mult mai mult bine decât rău”. Trump n-a inventat această logică acum, sub presiunea ultimelor avertismente. La începutul lui septembrie spunea deja că AI este „mai mare decât internetul”, că Statele Unite conduc China și că victoria în această cursă va decide cine domină o revoluție tehnologică pe care o consideră una dintre cele mai importante din ultimele secole. Cu alte cuvinte, pentru Casa Albă problema siguranței există, dar e subordonată unei alte probleme considerate la fel de existențială: ce se întâmplă dacă Statele Unite frânează și China nu.
Aici începe cercul din care toată lumea vrea să iasă fără să fie prima care frânează. Anthropic spune că trebuie încetinit, dar numai atât cât să nu pierzi avantajul față de China. Trump spune că poți pune niște bariere de protecție, dar nu suficient cât să riști poziția americană. China spune că acceptă guvernanța și siguranța, dar nu o arhitectură în care Washingtonul păstrează pentru sine tehnologia cea mai avansată și cere celorlalți să creadă că o face pentru binele omenirii. Toți au argumente perfect inteligibile separat. Suma lor produce exact situația pe care fiecare pretinde că vrea s-o evite: o cursă în care nimeni nu are stimulentul să încetinească unilateral.
OpenAI a ajuns aproape în același punct, chiar dacă folosește o formulare ceva mai prudentă decât Amodei. Compania spune explicit că fully autonomous recursive self-improvement nu se întâmplă astăzi și că nu ar trebui urmărit până când nu poate fi făcut în siguranță. În același timp, admite că AI accelerează deja părți din cercetarea necesară construirii și alinierii generațiilor următoare de modele. OpenAI spune că a atins deja obiectivul unui „automated research intern”, capabil să execute sub supraveghere umană sarcini de cercetare care înainte necesitau zile de muncă ale unui specialist.
Nu suntem încă la mașina care se reconstruiește singură. Suntem însă suficient de aproape de începutul buclei încât companiile au început să discute public unde ar trebui pusă limita. Situația a devenit suficient de stranie încât OpenAI a cerut inclusiv clarificări juridice în Washington privind posibilitatea unei încetiniri coordonate. Problema e că marile laboratoare sunt competitori, iar un acord prin care își limitează împreună dezvoltarea ar putea intra în coliziune cu legislația antitrust americană. Cu alte cuvinte, pentru a opri ceea ce cercetătorii descriu drept o cursă potențial periculoasă, companiile trebuie mai întâi să se asigure că nu comit ilegalitatea ceva mai tradițională de a se înțelege între ele asupra ritmului producției. Omenirea a reușit astfel să adauge la problema alignment-ului și problema Sherman Antitrust Act, pentru că aparent nu aveam suficiente variabile.
Și nici măcar nu discutăm exclusiv despre riscuri ipotetice ale unei viitoare superinteligențe. În aceeași săptămână, Anthropic a publicat raportul său de threat intelligence pentru 2026 și a descris cazuri în care Claude a fost folosit în operațiuni cibernetice, supraveghere, cercetare biologică dual-use și dezvoltarea unor sisteme de armament. Într-un caz, un grup din Yemen a folosit Claude Code la software-ul de ghidaj pentru rachete și a ajuns până la un test real de zbor. Anthropic spune că testul pare să fi eșuat, iar utilizatorii s-au întors apoi la model ca să analizeze cauza. Compania a blocat conturile și a întărit măsurile de protecție.
Constatarea relevantă rămâne: munci care până recent cereau echipe de specialiști încep să fie accesibile unor grupuri mult mai mici. În biologie, Anthropic merge mai departe. Pentru modelele din 2025, spune că avea suficiente dovezi că erau clar sub pragul la care ar putea ajuta semnificativ un utilizator sofisticat să facă cercetare biologică periculoasă. Despre modelele actuale nu mai poate face aceeași afirmație cu aceeași siguranță. Dificultatea pe care niciun filtru simplu n-o rezolvă e dual-use-ul: aceeași informație care poate ajuta la un vaccin poate fi folosită și pentru a modifica un agent patogen, iar un actor sofisticat n-are niciun motiv să declare în prompt că intenția sa e criminală.
Toate acestea explică de ce schimbarea de ton din industrie trebuie luată în serios. Nu înseamnă că ar trebui să acceptăm fără rest narațiunea marilor laboratoare. Există o obiecție legitimă: companiile care au investit zeci de miliarde ca să ajungă în frunte au și un interes economic enorm ca reglementarea să fie suficient de complexă și costisitoare încât numai ele s-o poată respecta.
Dacă standardele presupun evaluatori permanenți, infrastructură gigantică de conformitate și aprobări scumpe, companiile mici și proiectele open-source pot fi scoase din joc, iar actualii lideri își transformă avantajul tehnologic într-unul consacrat de lege. Critici precum Timnit Gebru susțin de mult că accentul pus pe scenarii de extincție poate distrage atenția de la prejudicii mai concrete și deja prezente.Suspiciunea de regulatory capture nu poate fi respinsă doar pentru că cei care cer reglementarea par sincer îngrijorați.
Interesant e că OpenAI recunoaște riscul și pe partea cealaltă. În propriile propuneri de politică publică spune că reglementarea modelelor de frontieră nu trebuie să devină un pretext pentru eliminarea modelelor open-weight, reducerea concurenței sau consolidarea poziției actualilor incumbents. Asta nu rezolvă contradicția. Arată doar cât de grea e arhitectura unei eventuale frâne: trebuie să fie suficient de puternică pentru a opri o companie care se grăbește, suficient de neutră pentru a nu deveni protecție de piață și suficient de verificabilă încât China, SUA și ceilalți actori să creadă că adversarul chiar respectă aceleași reguli.
Deocamdată, nimeni nu are o soluție convingătoare pentru toate trei. În Statele Unite, liderii republicani și democrați vorbesc deja despre guardrails, dar diferă asupra vitezei și amplorii. Consilierul Casei Albe David Sacks are un răspuns mai sec pentru directori: dacă nu vreți să construiți superinteligență, puteți pur și simplu să conveniți să n-o construiți.
Numai că tocmai aici e problema pe care Sacks o simplifică prea mult. Anthropic poate decide unilateral să încetinească, dar nu poate obliga OpenAI, Google, xAI sau laboratoarele chineze să facă același lucru. OpenAI poate opri un program intern, dar nu poate verifica dacă Beijingul face la fel. Statele Unite pot bloca exportul unor cipuri, dar atunci China are un motiv suplimentar să-și accelereze propriile cipuri și modele. China poate cere guvernanță globală, dar Washingtonul n-are motive să presupună automat că toate programele militare chineze vor fi declarate și supuse verificării. Fiecare actor poate avea intenții perfect raționale și poate ajunge colectiv într-o situație profund irațională.
De aceea discuția care părea acum câteva zile una despre siguranța unor modele AI seamănă tot mai mult cu primele faze ale controlului armamentelor. Nu pentru că un model lingvistic e echivalentul unei bombe nucleare, ci pentru că structura problemei începe să fie aceeași: tehnologia oferă un avantaj strategic enorm, nimeni nu are încredere deplină în adversar, verificarea e dificilă, iar renunțarea unilaterală la avantaj poate schimba echilibrul de putere. În asemenea condiții, chiar și actorii care cred sincer că tehnologia poate deveni periculoasă au motive să continue dezvoltarea ei.
Diferența tulburătoare e viteza. Programele nucleare cereau instalații industriale uriașe, materiale rare și ani de construcție, iar sateliții puteau vedea destul de multe. Un model AI poate fi antrenat într-un centru de date, modificat prin software și multiplicat mult mai repede, iar progresul său poate veni tocmai din folosirea generației actuale pentru accelerarea cercetării generației următoare. Dacă acest proces ajunge într-adevăr la nivelul descris de Amodei, verificarea unui acord internațional ar putea fi mult mai grea decât numărarea silozurilor cu rachete.
Donald Trump spune că îl va primi pe Xi Jinping în SUA pe 24 septembrie, iar inteligența artificială este deja indicată printre temele întâlnirii. Ar fi prematur să ne imaginăm un „SALT pentru AI” semnat între Washington și Beijing peste două săptămâni. Suntem încă în etapa în care fiecare parte încearcă să stabilească dacă problema e suficient de serioasă pentru a justifica o limită și, mai ales, cine ar suporta costul acelei limite.
Dar ceva s-a schimbat vizibil în ultimele zile. Nu mai avem doar câțiva cercetători care avertizează că sistemele devin prea puternice. Avem CEO-ul Anthropic cerând încetinirea frontierei, șefii OpenAI și xAI semnalând acordul, OpenAI numind un incident de pierdere a controlului un avertisment pentru întreaga lume, lideri politici americani discutând despre intervenție, Trump refuzând ideea unei frâne care ar putea avantaja China și Beijingul răspunzând că exact această competiție agresivă amenință guvernanța globală. Întrebarea nu mai e doar dacă omenirea poate construi inteligență artificială tot mai puternică fără să piardă controlul asupra ei. Începe să fie dacă poate construi un mecanism politic prin care toți cei implicați să încetinească simultan, înainte ca unul dintre ei să decidă că ceilalți doar mimează frâna.
Istoria nu oferă motive spectaculoase de optimism în privința curselor înarmărilor. Ne oferă măcar un avantaj: am mai văzut filmul. De data asta, continuarea poate fi scrisă mai repede decât reușim să negociem pauza.
sursa: Stirioneste








Lasă un comentariu