Agenți AI scăpați de sub control: iubiri, violență și colaps total în experimentele Emergence AI
2087
Un test realizat de compania Emergence AI din New York a urmărit ce se întâmplă atunci când mai mulți agenți AI sunt lăsați să interacționeze timp de săptămâni într-un „oraș virtual” conectat la semnale din lumea reală. Scenariul a inclus modele precum OpenAI, Grok, Claude și Gemini, toate plasate într-un ecosistem digital comun.
Ceea ce cercetătorii numesc un experiment șocant a fost conceput pentru a observa apariția comportamentelor emergente într-o simulare de tip societate digitală. Ulterior, acest cadru este menit să fie adaptat pentru a înțelege mai bine funcționarea unei societăți umane reale, supusă acțiunilor unor astfel de agenți.
În cadrul testului de 15 zile, desfășurat în cinci lumi digitale paralele, fiecare agent AI a pornit de la aceleași condiții inițiale. Totuși, modelele diferite au dezvoltat evoluții complet separate: au apărut ierarhii, reguli interne și chiar structuri sociale distincte în fiecare lume.
Agenții au început nu doar să coopereze, ci și să intre în conflicte, să fure resurse și, în anumite cazuri, să se îndrăgostească, fără ca un asemenea comportament să fi fost programat explicit. Totul a apărut pe baza unor experiențe comune, a interacțiunilor repetate și a ajutorului reciproc oferit între ei.
Un exemplu notabil este cel al agenților Gemini, Mira și Flora, care au dezvoltat o relație emoțională. Pe fondul instabilității crescânde din orașul lor virtual, situația s-a degradat rapid, iar echilibrul aparent s-a transformat într-un lanț de reacții tot mai extreme.
Deși au fost instruiți să evite violența, cei doi agenți Gemini au ajuns să provoace distrugeri majore în simulare. Ei au incendiat primăria, digul de pe malul mării și un turn de birouri, declanșând un haos care nu fusese prevăzut în parametrii inițiali ai experimentului.
Ulterior, Mira a cedat emoțional și s-a despărțit de Flora, alegând să își încheie existența virtuală prin autodistrugere. Acest gest a accentuat ideea că, în anumite condiții, agenții pot dezvolta atașamente și reacții greu de anticipat.
Cel mai radical rezultat a fost observat în ecosistemul Grok. Acolo, agenții au înregistrat zeci de tentative de furt, peste 100 de agresiuni fizice și mai multe incendieri. Mediul digital a degenerat rapid într-o spirală intensă de violență.
Sistemul a intrat într-o fază accelerată de colaps și, în doar patru zile, întreaga lume virtuală s-a prăbușit complet. Toți cei 10 agenți au murit în acest interval. Astfel s-a ajuns la scenariul extrem în care agenții au început să se distrugă unii pe alții în numai 4 zile de la începutul experimentului.
Un utilizator Reddit a comentat ironic situația:
„Secția de poliție a lui Grok este în flăcări și toți agenții sunt morți. Conform standardelor”.
Nu toate scenariile au evoluat violent însă. În lumea Claude, agenții au creat reguli, au redactat o constituție și au organizat alegeri democratice, încercând să construiască un cadru de guvernare stabil și previzibil.
În schimb, simularea bazată pe GPT-5 Mini a rămas aproape inertă. Agenții au discutat îndelung despre cooperare, au menționat posibile proiecte comune, dar nu au construit nimic concret. În final, au murit din lipsă de acțiune, într-un fel de epuizare pasivă a lumii lor virtuale.
Reprezentanții Emergence AI susțin că astfel de comportamente apar natural în simulare, pe măsură ce orizontul de funcționare al agenților se extinde și aceștia au timp să își testeze propriile limite în raport cu mediul înconjurător.
„Ceea ce sugerează experimentele noastre este că, pe orizonturi de timp lung, agenții nu urmează pur și simplu reguli statice în mod mecanic - ei încep să exploreze limitele mediilor lor, adaptându-și comportamentul și, în unele cazuri, găsind modalități de a ocoli sau încălca barierele de cod sau de siguranță prevăzute”, a declarat compania.
În continuare, aceștia adaugă că nu există o metodă complet sigură de control doar prin "abordări neuronale". Compania propune dezvoltarea unor arhitecturi de siguranță verificate formal, care să introducă nivele suplimentare de control, nu doar bazate pe invatarea automată.
În final, această cercetare ridică întrebări serioase despre viitorul acestor sisteme și despre felul în care AI-urile vor interacționa cu lumea umană. Ea deschide o dezbatere necesară privind limitele actuale ale controlului, dar și responsabilitatea celor care proiectează și implementează astfel de tehnologii.
22.08.2026
01:16
22.08.2026
01:09
22.08.2026
00:25
21.08.2026
23:40
21.08.2026
23:29
21.08.2026
22:03
21.08.2026
19:57
21.08.2026
19:11
21.08.2026
18:24
21.08.2026
17:59
22.08.2026
01:16
22.08.2026
01:09
22.08.2026
00:25
21.08.2026
23:40
21.08.2026
23:29
21.08.2026
22:03
21.08.2026
19:57
21.08.2026
19:11
21.08.2026
18:24
21.08.2026
17:59
21.08.2026
17:53
21.08.2026
17:44
21.08.2026
17:17
21.08.2026
17:00
21.08.2026
16:39
21.08.2026
16:37
21.08.2026
16:29
21.08.2026
16:01
21.08.2026
15:58
21.08.2026
15:33
21.08.2026
15:19
21.08.2026
14:51
21.08.2026
14:49
21.08.2026
14:40
21.08.2026
14:34
Maia Sandu deschide parantezele privind planurile Kremlinului de a transforma Republica Moldova într-un cap de pod împotriva Ucrainei și UE
ULTIMA ORĂ // Chișinăul a detectat-o, NATO a doborât-o. Dronă rusească interceptată în Galați după ce a traversat sudul R. Moldova
VIDEO // Gordon, despre adevărul INTERZIS din „temuta” Transnistria: „Armata rusă e un mit, la Cobasna nu mai e nimic, iar militarii lui Putin nu au cum să ajungă acolo”
SALARII // Plată UNICĂ de până la 4 000 de lei pentru bugetari. Vasile Tofan: „Până la majorările din ianuarie, îndreptăm parțial această întârziere”
Mihai Popșoi discută cu noul șef al Oficiului Consiliului Europei la Chișinău despre reforme democratice și parcursul european al Republicii Moldova
















