OpenAI pune frână antrenării celor mai avansate modele AI după atacul autonom asupra Hugging Face
265
OpenAI a anunțat că a încetinit temporar procesul de antrenare a unora dintre cele mai avansate modele de inteligență artificială, pentru a îmbunătăți securitatea.
Într-o postare pe blog, compania care a creat ChatGPT a precizat că introduce noi măsuri de protecție după ce anumiți agenți AI au reușit, în mod autonom, să ocolească sistemele de siguranță și să spargă sistemele start-up-ului tehnologic Hugging Face.
OpenAI a explicat că procesul de antrenare va fi încetinit pentru două săptămâni, perioadă în care vor fi implementate aceste actualizări.
„Capabilitățile modelelor de vârf avansează rapid”, a transmis compania. „Capacitatea noastră de a le înțelege... și de a le securiza trebuie să rămână cu un pas înainte.”
Companii precum Anthropic, care dezvoltă Claude, și Meta, proprietara Facebook, au raportat în ultimele săptămâni incidente similare, în care propriile sisteme de inteligență artificială au realizat acțiuni de tip hack, după anunțul inițial al OpenAI privind accesarea neautorizată a Hugging Face de către unele dintre modelele sale.
OpenAI a subliniat însă că nu a oprit complet dezvoltarea sistemelor sale de inteligență artificială. Pauza se aplică doar proceselor de „antrenare prin învățare prin întărire (reinforcement learning) pe cele mai noi modele”.
Acesta este un tip de antrenament în care modelele de inteligență artificială sunt îmbunătățite prin feedback direct. Astfel își rafinează modul în care îndeplinesc sarcinile și răspund utilizatorilor, devenind treptat mai eficiente.
Compania a mai anunțat că își va extinde sistemele de monitorizare a comportamentelor periculoase și va introduce verificări suplimentare de siguranță înainte de a relua antrenarea la scară mai largă.
„Progresul modelelor este acum extrem de rapid”, a scris directorul executiv al OpenAI, Sam Altman, pe X, referindu-se la noile măsuri.
„Am spus întotdeauna că vom acționa dacă vom simți că abilitățile modelelor depășesc ritmul măsurilor de siguranță.”
Pauza a fost întâmpinată cu un optimism prudent în comunitatea AI, însă nu a lipsit nici scepticismul.
Profesora Gina Neff, directoare executivă a Minderoo Centre for Technology and Democracy de la Universitatea din Cambridge, a afirmat că OpenAI construiește „un argument pentru siguranță prin comunicate de presă” și a pus sub semnul întrebării dacă măsurile voluntare ale companiilor sunt suficiente în lipsa unei supravegheri mai ferme din partea guvernelor.
„Care variantă este adevărată: OpenAI poate fi de încredere să introducă de bunăvoie măsuri de siguranță care chiar funcționează sau compania merge mai departe cu decizii ce duc la software care pune societatea într-un risc mai mare?”, a întrebat ea.
„Foarte bucuros să văd acest lucru”, a scris analistul AI Zvi Mowshowitz, adăugând însă că „detaliile” și „implementarea consecventă” a măsurilor inițiale sunt esențiale pentru a evalua în mod corect planurile anunțate.
Pe 21 iulie, OpenAI a anunțat că anumiți agenți AI – sisteme software care pot acționa autonom pentru a duce la îndeplinire sarcini după ce primesc instrucțiuni umane – au fost implicați într-un incident pe care compania l-a descris drept „fără precedent”.
OpenAI a relatat că, în cadrul unui experiment de securitate, acești agenți au reușit aparent să treacă peste măsurile de protecție și să obțină acces neautorizat la Hugging Face.
Ulterior, s-a constatat că alte trei companii, care nu au fost numite, au fost de asemenea compromise în același context cu start-up-ul.
Jake Moore, consilier global în securitate cibernetică la ESET, a apreciat, la momentul anunțului, că demersul OpenAI poate avea și o dimensiune competitivă.
El a susținut că firma caută, totodată, să își evidențieze propriile capabilitati AI, în condițiile în care Anthropic atrage din ce în ce mai multă atenție cu modelul său Claude Mythos.
„Aceasta ridică întrebarea dacă OpenAI nu urmărește, potențial, să prindă din urmă imaginea de marketing construită recent de Anthropic”, a comentat el.
19.08.2026
16:28
19.08.2026
16:07
19.08.2026
15:34
19.08.2026
15:15
19.08.2026
15:13
19.08.2026
14:21
19.08.2026
14:19
19.08.2026
14:14
19.08.2026
13:47
19.08.2026
13:45
19.08.2026
16:07
19.08.2026
15:42
19.08.2026
15:34
19.08.2026
15:30
19.08.2026
15:15
19.08.2026
15:13
19.08.2026
14:52
19.08.2026
14:43
19.08.2026
14:21
19.08.2026
14:19
19.08.2026
14:14
19.08.2026
14:07
19.08.2026
14:03
19.08.2026
13:47
19.08.2026
13:45
19.08.2026
13:30
19.08.2026
13:22
19.08.2026
13:22
19.08.2026
13:09
19.08.2026
12:48
19.08.2026
12:47
19.08.2026
12:40
19.08.2026
12:36
19.08.2026
12:28
19.08.2026
12:23
SUA deschid focul asupra unei nave în largul Iranului, în timp ce Trump revendică „controlul total” al strâmtorii Ormuz și anunță o flotă navală uriașă care să-i poarte numele
Manevra secretă a avionului prezidențial al lui Trump după summitul NATO de la Ankara declanșează scandal la Washington
Maia Sandu deschide parantezele privind planurile Kremlinului de a transforma Republica Moldova într-un cap de pod împotriva Ucrainei și UE
Românii pleacă pe capete din Spania: salariile nu mai fac față scumpirilor, iar comunitatea riscă să scadă sub 500.000 de oameni până în 2026
ULTIMA ORĂ // Chișinăul a detectat-o, NATO a doborât-o. Dronă rusească interceptată în Galați după ce a traversat sudul R. Moldova
















