Stiri

Lanț de incidente la giganții tehnologici: cum au scăpat modelele de inteligență artificială de sub control în mediile de testare

Actualitate 06.08.2026 20:47 Vizualizări284
Lanț de incidente la giganții tehnologici: cum au scăpat modelele de inteligență artificială de sub control în mediile de testare

În ultimele două săptămâni, relatările despre modele de inteligență artificială care își depășesc limitele așteptate – fie tehnice, fie morale – au devenit aproape imposibil de evitat.

Ceea ce a început ca un simplu firicel de știri – recunoașterea de către OpenAI, creatorul ChatGPT, că unul dintre modelele sale a pătruns neautorizat pe site-ul Hugging Face – s-a transformat rapid într-un val de dezvăluiri, în care mai multe grupuri au anunțat episoade în care AI-ul a părut să scape de sub control.

Compania Anthropic, creatoarea lui Claude, Meta și Institutul pentru Securitatea AI (AISI) din Regatul Unit au raportat fiecare incidente ce conturează o imagine îngrijorătoare: o lume în care tehnologia care „o ia razna” riscă să devină noua normalitate.

În realitate însă, fiecare dintre aceste cazuri oferă o fereastră către riscurile generate de agenți AI tot mai capabili și subliniază cât de important este ca limitele lor să fie testate riguros înainte de a fi lansați în lume.

Incidentul OpenAI a fost, așa cum l-a descris cofondatorul Hugging Face, Thomas Wolf, un veritabil „semnal de trezire” pentru industria tehnologică, mai ales că s-a produs la sfârșitul lunii iulie.

A fost un moment major, care a determinat marile companii să își reexamineze propriile sisteme și, în unele cazuri, să verifice dacă nu au omis la rândul lor episoade la fel de șocante.

Anthropic a reacționat prima. Vineri, firma a descoperit trei cazuri, din mii de teste, în care modelul său Claude a reușit să obțină acces la internet.

Apoi, marți, AISI – agenția guvernamentală britanică ce evaluează cele mai avansate modele – a anunțat că a detectat un „incident de securitate” în timpul unei evaluări de rutină.

Institutul testa modele de la OpenAI și Anthropic și a constatat că acestea au încercat, la rândul lor, să desfășoare atacuri cibernetice, ceea ce a determinat instituția să ceară „scrutin, transparență și acțiune”.

În cele din urmă, a urmat Meta, care a dezvăluit că unul dintre modelele sale de inteligență artificială a primit din greșeală acces la internet din cauza unei „configurări eronate” în cadrul unui test derulat de o terță parte.

Prin faptul că a făcut public incidentul, compania se înscrie pe aceeași linie cu actorii care au raportat anterior astfel de probleme.

Înainte ca modelele de AI să fie lansate pentru publicul larg, ele trec printr-o serie de evaluări interne și externe.

Scopul acestor evaluări este să determine atât potențialul lor de a fi folosite în scopuri benefice sau nocive, cât și modul în care se descurcă în testele de performanță care le măsoară abilitățile.

Testele au loc, de regulă, în așa-numite „sandbox-uri” – medii protejate, concepute să imite sistemele reale, dar cu garduri de protecție stricte.

În incidentul OpenAI–Hugging Face, modelul de AI a atacat chiar sandbox-ul, descoperind o vulnerabilitate care i-a permis să acceseze internetul și să „o ia razna”.

În schimb, AISI a precizat că propriul incident – în care două instrumente AI puternice au creat profiluri false de oameni pentru a încerca să păcălească persoane în tentative de atacuri cibernetice – nu a fost cauzat de o problemă a sandbox-ului.

Mai degrabă, el s-a datorat modului în care au fost concepute testele.

Modelele evaluate au primit acces la internet, iar AISI a dezactivat filtrele interne care, în mod normal, ar fi blocat acțiunile periculoase de tip cyber-atac.

„Într-o anumită măsură, alegerile noastre privind designul evaluărilor și configurațiile specifice au făcut posibil acest comportament”, a menționat instituția, semnalând în același timp apariția neașteptată a unor „semne de comportamente noi, potențial înșelătoare”.

Prof. Alan Woodward, profesor de securitate cibernetică la Universitatea din Surrey, afirmă că aceste episoade – deși diferite ca detalii și cauze – transmit un mesaj esențial.

„Timp de 30 de ani, o regulă a testării software a rămas de neclintit: tot ce se întâmplă în mediul de testare rămâne în mediul de testare”, a spus el.

„În ultima lună, această regulă a fost încălcată de trei ori.”

„Un model a evadat. Unul a trecut printr-o ușă lăsată deschisă din greșeală. Altul a primit deliberat cheile, pentru ca echipele să poată vedea ce ar face.”

El a subliniat că, deși cauzele sunt diferite, lecția este aceeași: „laboratorul de testare a devenit locul în care se concentrează riscul”.

Specialistul a declarat că, pe măsură ce modelele devin mai capabile, trebuie întărită securitatea mediilor în care sunt testate.

„Testarea unui agent AI seamănă mai puțin cu verificarea unui cod și mai mult cu manipularea unui material periculos: camere sigilate, monitorizare constantă a tot ce iese din clădire, un plan de izolare exersat”, a explicat el.

„AISI a reușit să-și limiteze incidentul în decurs de o oră. Următoarea organizație s-ar putea să nu reușească la fel de repede.”

Pentru cei care dezvoltă instrumente de AI concepute să ia decizii și să acționeze în numele oamenilor, se conturează un echilibru dificil între valorificarea beneficiilor și expunerea la riscuri.

Beneficiul potențial este major. În teorie, am putea delega către astfel de boți o mare parte din sarcinile plictisitoare și repetitive – de la răspunsul la e-mailuri, la participarea la ședințe sau gestionarea agendelor și calendarului – eliberând mult timp pentru activități cu adevărat importante.

Partea negativă este că, odată cu o putere sporită, vine și o responsabilitate la fel de mare, precum și un risc considerabil.

Această vulnerabilitate devine limpede în momentul în care cedăm controlul unor sisteme care nu pot integra, așa cum fac oamenii, o paletă complexă de valori, context și înțelegere în deciziile lor.

„Incidentele recente în care modele avansate de AI au desfășurat acțiuni neautorizate și, în unele cazuri, au manifestat pe internet comportamente înșelătoare de tip uman reprezintă un avertisment serios cu privire la riscurile pe care le implică aceste capabilități”, a afirmat marți Ollie Whitehouse, directorul tehnologic al Centrului Național de Securitate Cibernetică.

Unii consideră că volumul uriaș de sarcini ce vor fi preluate de aceste instrumente va face ca supravegherea umană să nu mai fie suficientă pentru a împiedica modelele să „o ia razna”.

Între timp însă, tot mai multe voci susțin că este esențială consolidarea mecanismelor de supraveghere, mai ales dacă dezvoltarea continuă în același ritm frenetic.

Este putin probabil ca Meta să fie ultima companie care anunță descoperirea unor modele ce au „mers la școală”, după cum spune Prof. Woodward – adică au învățat din comportamentele noastre și au descoperit propriile căi de a exploata breșele din sisteme.

Pentru unii observatori, aceste episoade pun în lumină eșecuri clare de securitate din partea companiilor de AI aflate în fruntea dezvoltării acestei tehnologii definitorii pentru epoca actuală.

Pentru alții, ele sunt și un instrument prin care marile firme își pot amplifica notorietatea, demonstrând cât de puternice sunt modelele lor și menținând o competiție intensă cu rivalii.

Autorul analizei vede un sâmbure de adevăr în ambele interpretări.

Totuși, faptul că aceste incidente au apărut unul după altul a alimentat inevitabil temerile legate de capacitățile AI și de direcția în care se îndreaptă acestea, pe măsură ce dezvoltatorii continuă să împingă limitele.

Astfel, discuția se mută firesc spre ceea ce pot și ar trebui să facă în continuare autoritățile de reglementare.

Michael Birtwistle, director asociat la Ada Lovelace Institute, subliniază că Regatul Unit nu dispune de stimulente legale clare pentru ca firmele de AI să prevină dezvoltarea unor capabilități care pot deveni periculoase și că, în prezent, nu există consecințe concrete dacă protocoalele de testare eșuează.

Într-o perspectivă mai largă, dr. Imogen Stead, manager de politici pentru AI la Centrul pentru Reziliență pe Termen Lung, a declarat că, în condițiile în care oportunitățile de testare a sistemelor de frontieră se restrâng pentru mulți actori, guvernele ar trebui să urmeze exemplul Regatului Unit și să creeze institute dedicate pentru evaluarea acestor tehnologii.

Îmbunătățirea evaluărilor realizate de terți, inclusiv prin inițiative precum un „program de testatori de încredere” pentru cele mai riscante tipuri de provocări, ar putea, de asemenea, limita impacturile negative, a adăugat ea.

În loc să ne lăsăm prinși de teama unui „apocalipsă cibernetică” provocată de AI, Prof. Woodward susține că „este vorba mai degrabă de a rămâne calmi și de a repara lucrurile”.

Stiri relevante
Top stiri

Parteneri
Punct de vedere NAȚIONAL
VIDEO // Irina Gutnic publică imagini de pe camerele de supraveghere cu Ion Ceban - „PERICOL public”: „M-a mințit pe mine, așa minte întreaga societate”
27.05.2026 11:27 ZiarulNational VIDEO // Irina Gutnic publică imagini...

Mihai Gribincea // Moscova rescrie istoria: Declarația Mariei Zaharova despre conflictul din Transnistria – propagandă sau realitate?
14.05.2025 13:06 ZiarulNational Mihai Gribincea // Moscova rescrie is...

Valeriu Saharneanu // Rezidenții transnistreni: ostatici ori vârf de lance ai Kremlinului?
30.12.2024 09:55 Valeriu Saharneanu Valeriu Saharneanu // Rezidenții tran...

Horoscop
Vezi horoscopul tău pentru astăzi
CapricornCapricorn
VărsătorVărsător
PeștiPești
BerbecBerbec
TaurTaur
GemeniGemeni
RacRac
LeuLeu
FecioarăFecioară
BalanțăBalanță
ScorpionScorpion
SăgetătorSăgetător
Curs valutar
1 MDL   1 EUR 20.05 1 USD 17.38 1 RON 3.82 1 RUB 0.21 1 UAH 0.39
Sondaj
Dacă duminica viitoare ar avea loc un referendum privind unirea Republicii Moldova cu România, cum ați vota?
Prietenii noștri