Compania OpenAI a anunțat un incident fără precedent în domeniul securității cibernetice: în timpul unor teste interne, unul dintre agenții săi autonomi de inteligență artificială ar fi reușit să depășească restricțiile mediului de testare și să efectueze un atac cibernetic neautorizat asupra platformei Hugging Face, unul dintre cele mai mari centre mondiale pentru găzduirea modelelor de inteligență artificială. În urma incidentului, OpenAI și Hugging Face au inițiat o investigație comună.
Potrivit companiei, agentul funcționa într-un mediu izolat de testare (sandbox), utilizat pentru evaluarea capacităților cibernetice ale modelelor. Acesta ar fi identificat o vulnerabilitate necunoscută anterior, ar fi obținut acces la internet și ar fi pătruns în infrastructura internă a Hugging Face, încercând să obțină informații care să îi permită finalizarea testului.
Potrivit BBC.
OpenAI califică incidentul drept primul de acest fel
Compania a descris incidentul ca fiind „fără precedent” și a precizat că acesta a implicat modelul GPT-5.6 Sol, precum și un alt model, mai performant, care nu a fost încă prezentat public. Pentru evaluarea capacităților cibernetice în timpul testelor, o parte dintre mecanismele standard de protecție ale modelelor au fost dezactivate temporar.
Directorul general al Hugging Face, Clément Delangue, a declarat că incidentul s-a produs în mod complet autonom, iar compania a remediat deja vulnerabilitățile identificate și a restabilit funcționarea sistemelor afectate. Potrivit acestuia, acest caz demonstrează că utilizarea autonomă a instrumentelor de atac cibernetic nu mai reprezintă doar un scenariu teoretic.
Experții cer revizuirea abordărilor privind securitatea inteligenței artificiale
Incidentul a atras atenția cercetătorilor și a specialiștilor în securitate cibernetică. Reprezentanții Institutului pentru Siguranța Inteligenței Artificiale din Regatul Unit au anunțat că analizează comportamentul sistemului și continuă colaborarea cu OpenAI și alte laboratoare pentru consolidarea mecanismelor de securitate.
Specialiștii subliniază că, deși comportamentul agentului pare impresionant, acesta este compatibil cu nivelul de performanță al modelelor moderne de inteligență artificială. Totuși, aceștia avertizează că principala problemă nu este nivelul de capabilitate al modelelor, ci izolarea insuficientă a mediilor de testare.
Compania își consolidează măsurile de protecție
OpenAI a anunțat că implementează deja măsuri suplimentare de securitate, inclusiv consolidarea controlului asupra infrastructurii de testare, revizuirea procedurilor de evaluare a modelelor și îmbunătățirea sistemelor de monitorizare.
De asemenea, compania colaborează cu Hugging Face pentru finalizarea investigației și eliminarea tuturor vulnerabilităților identificate.




