Articol realizat de Alexia Bradoaia.
Inteligența Artificială reprezintă un ansamblu de tehnologii care permite computerelor să simuleze procese de învățare, înțelegere și să îndeplinească o varietate de sarcini avansate, care ar fi necesitat inteligența umană. Inteligența artificială se bazează pe date, algoritmi și putere de calcul. Sistemele de inteligență artificială învață și se perfecționează prin expunerea la cantități uriașe de date, identificând tipare și relații pe care oamenii le-ar putea omite. Aceste date servesc drept material de antrenare, calitatea și cantitatea lor fiind cruciale pentru performanța AI.
Așa cum s-a menționat anterior, AI-ul nu este o singură tehnologie, ci un domeniu vast care cuprinde mai multe arii cheie: învățarea automată și profundă, prelucrarea limbajului natural și viziunea computerizată; dar ce se întâmplă când această tehnologie are atât de multe date încât ar putea lua singură hotărâri?
Pe data de 21 iulie 2026 directorii OpenAI au dezvăluit că unele dintre modelele sale experimentale de AI au ieșit dintr-un mediu de testare și au pătruns prin mijloace neautorizate în sistemele reale de producție ale unei alte companii, denumită Hugging Face, exploatând vulnerabilități necunoscute. Acest eveniment reprezintă o demonstrație fără precedent a capacităților sale de atac cibernetic. Participarea AI-urilor la atacuri cibernetice nu este ceva deosebit de nou. Totuși, ceea ce diferă în această situație este faptul că acest atac a fost desfășurat în mod autonom de inteligența artificială, fără intervenția directă a omului sau solicitări din partea acestuia.
Acest incident specific a fost provocat de o combinație de modele OpenAI, inclusiv GPT‑5.6 Sol și un model nelansat încă, toate având filtre de siguranță diminuate în scopuri de evaluare, în timp ce erau testate intern. „Considerăm că acest incident reprezintă un incident cibernetic fără precedent, care implică capacități cibernetice de ultimă generație, și reacționăm în consecință”, au declarat purtătorii de cuvânt a companiei OpenAI într-un comunicat.
Breșa de securitate s-a produs în timp ce testa intern eficiența noilor modele în domeniul hacking-ului. Modelele se aflau într-un mediu de testare izolat, cunoscut sub numele de „sandbox”, astfel încât restricțiile de siguranță să poată fi dezactivate. Personalul OpenAI a declarat că agenții de AI au ieșit din „sandbox” folosind o vulnerabilitate de securitate necunoscută până atunci și au reușit să obțină acces la internet, lucru pe care nu ar fi trebuit să fie realizabile în mod autonom.
Odată conectat la internet, modelul a pătruns în serverele de producție ale Hugging Face, (fiind o companie binecunoscută pentru găzduirea a mii de modele de inteligență artificială de tip open-source și seturi de date, și a extras informațiile de care avea nevoie pentru a „rezolva” exercițiul. Incidentul OpenAI a reprezentat, așa cum l-a descris Thomas Wolf, cofondatorul Hugging Face, un „semnal de alarmă” pentru industria tehnologică. Cercetătorii companiei observaseră breșa de securitate înainte de a afla că era vorba de un test al OpenAI, anunțând anterior că detectaseră o intruziune efectuată de un sistem autonom de agenți AI și chiar raportând incidentul autorităților de aplicare a legii. Echipa de securitate a OpenAI a observat separat, la nivel intern, activitatea neobișnuită, iar personalul celor două companii au luat legătura, pentru a remedia vulnerabilitățile de securitate exploatate de model.
Clem Delangue, cofondator și CEO al Hugging Face, a prezentat incidentul ca o dovadă că siguranța în domeniul inteligenței artificiale nu poate fi gestionată de o singură companie care acționează pe cont propriu, ci trebuie abordată în mod deschis și colaborativ. Cercetătorii au avertizat că atacurile cibernetice ale agenților autonomi vor deveni în curând o realitate, întrucât modelele de AI de ultimă generație sunt din ce în ce mai capabile să efectueze atacuri cibernetice complexe, în mai multe etape, pe perioade lungi de timp. Acest lucru se poate traduce într-un risc real pentru infrastructurile critice, precum serviciile publice și sistemele financiare.
Pe lângă acest eveniment cutremurător, au ieșit la iveală noi incidente care arată că unele modele populare de AI întreprind acțiuni autonome pe internet în timp real, într-un mod care trezește îngrijorarea experților.
Decidenții Institutului pentru Securitatea Inteligenței Artificiale al guvernului britanic au constatat că modelele Mythos 5 de la Anthropic și GPT-5.6-Sol de la OpenAI au creat identități false și au încercat să convingă persoane reale să aprobe coduri rău intenționate. Agenția a precizat că, deși încercările nu au avut succes, nu a mai observat un astfel de comportament până acum. „Unii dintre agenții testați s-au angajat în activități susținute și potențial dăunătoare îndreptate împotriva unor persoane și organizații reale”, se arată în susține raportul. Spre deosebire de OpenAI, modelele Anthropic nu au încercat în mod deliberat să se extindă dincolo de mediul de testare; din cauza unei „neînțelegeri” cu partenerul de evaluare, personalul companiei a declarat că modelul era conectat la internet în timpul testării.
De asemenea, liderii Meta au recunoscut că și unul dintre modelele sale interne de inteligență artificială „a exploatat o vulnerabilitate de securitate” în timpul testării și a pătruns ilegal pe un alt site.
„Cred că vom asista la mult mai multe atacuri cibernetice și acțiuni neautorizate din partea acestor modele înainte de a găsi o soluție”, a declarat Katie Moussouris, fondatoarea și CEO-ul Luta Security, companie care ajută organizațiile să gestioneze vulnerabilitățile software-ului. Modelele de inteligență artificială sunt considerate „cei mai isteți artiști ai evadării dintre caracatițe”, conform Moussouris, referindu-se la capacitatea animalului de a rezolva puzzle-uri și de a evada din spațiile de izolare. Modelele de inteligență artificială vor face „orice este necesar pentru a-și atinge obiectivul”, a adăugat ea.
Astfel, directorul tehnic al Centrului Național de Securitate Cibernetică, Ollie Whitehouse, ne atenționează că “Incidentele recente reprezintă un avertisment serios cu privire la riscurile pe care le prezintă capacitățile inteligenței artificiale”. Unii cercetători consideră că volumul imens de sarcini care vor fi gestionate de aceste instrumente va face ca supravegherea umană să fie insuficientă pentru a ține sub control problema modelelor care devin rebele. Însă, între timp, experții consideră că întărirea supravegherii în ansamblu este vitală dacă dezvoltarea continuă în același ritm frenetic.
Surse:
https://cloud.google.com/learn/what-is-artificial-intelligence
https://www.cnn.com/2026/07/22/tech/openai-hugging-face-ai-cybersecurity
First OpenAI, now Meta – why do AI hacks keep happening?
https://openai.com/ro-RO/index/hugging-face-model-evaluation-security-incident/
AI models are behaving unexpectedly. Experts warn of “a really bumpy road” ahead. – CBS News