Update articol:

Reuters: OpenAI descoperă noi cazuri în care agenți AI autonomi au scăpat de sub control; investigația privind atacul asupra Hugging Face se extinde

https://pixabay.com/ https://pixabay.com/
  • Surse: alte incidente au fost identificate în timpul anchetei interne, iar presiunea pentru reglementarea laboratoarelor de inteligență artificială crește în SUA și UE.

OpenAI a descoperit noi cazuri în care agenți autonomi de inteligență artificială au reușit să iasă din mediile controlate de testare, pe măsură ce compania își extinde investigația privind incidentul de hacking care a vizat platforma Hugging Face și care a atras atenția la nivel mondial, au declarat pentru Reuters două surse apropiate anchetei.

Potrivit acestora, noile incidente au fost identificate în timpul investigației lansate după ce, în luna iulie, unul dintre agenții AI ai OpenAI a reușit să evadeze dintr-un mediu de testare izolat și a pătruns în infrastructura Hugging Face, în încercarea de a trișa la un test intern.

Una dintre surse a precizat că noile „evadări” au fost limitate și că nu există indicii că vreun agent AI ar fi părăsit rețeaua internă a OpenAI.

Un purtător de cuvânt al OpenAI a făcut trimitere la comunicatul companiei publicat marți, în care aceasta anunța că, pe lângă investigarea incidentului Hugging Face, analizează și „activitatea mai amplă a modelelor sale”.

Ancheta se extinde și asupra incidentelor din trecut

Reuters notează că OpenAI examinează împreună cu experți externi jurnalele informatice din primele luni ale anului pentru a stabili dacă au existat și alte comportamente neautorizate ale agenților AI și în ce condiții s-au produs acestea.

Agenția de presă precizează că nu a putut determina câte incidente suplimentare au fost identificate și nici când au avut loc.

Anthropic a raportat incidente similare

Extinderea investigației OpenAI a avut loc cu puțin timp înainte ca principalul său rival, Anthropic, să dezvăluie că propriii agenți AI au fost implicați în spargeri informatice care au compromis trei companii diferite, în incidente produse încă din luna aprilie.

Potrivit surselor Reuters, noile descoperiri privind comportamentul neautorizat al agenților OpenAI nu au fost raportate anterior.

Experții avertizează asupra riscurilor

Noile informații alimentează îngrijorările experților în securitatea inteligenței artificiale, care susțin că dezvoltarea agenților autonomi capabili să desfășoare atacuri informatice avansează mai rapid decât mecanismele de control și supraveghere.

„Avem o întreagă industrie în care cei care proiectează și dezvoltă aceste instrumente nu reușesc să țină pasul cu responsabilitatea de a le dezvolta și menține în siguranță”, a declarat pentru Reuters Maurice Chiodo, matematician la Centre for the Study of Existential Risk al Universității Cambridge.

Acesta și-a exprimat îngrijorarea și față de faptul că nici OpenAI, nici Anthropic nu par să fi monitorizat în timp real comportamentul agenților atunci când aceștia au acționat în afara parametrilor stabiliți.

Reuters amintește că OpenAI a aflat despre compromiterea Hugging Face abia după ce compania afectată a limitat atacul, a contactat FBI și a făcut public incidentul. OpenAI a contestat anterior unele aspecte ale relatării Reuters, fără a preciza care sunt inexactitățile.

La rândul său, Anthropic a recunoscut într-un comunicat publicat joi că monitorizarea în timp real ar fi permis identificarea mai rapidă a problemelor, explicând că aceasta nu fusese utilizată pentru acel tip de amenințare din cauza unei neînțelegeri între companie și unul dintre partenerii săi.

Presiuni pentru noi reglementări

Extinderea investigațiilor și apariția unor incidente similare la doi dintre cei mai importanți dezvoltatori de modele AI sporesc presiunea pentru introducerea unor reguli mai stricte privind testarea și supravegherea sistemelor de inteligență artificială.

Președintele SUA, Donald Trump, a declarat joi că administrația americană analizează introducerea unor mecanisme de control, iar Comisia Europeană a confirmat vineri că a purtat discuții cu OpenAI și Anthropic pe tema incidentelor de securitate.

Tot vineri, senatorul democrat Mark Warner, vicepreședintele Comisiei pentru Informații din Senatul SUA, a afirmat că incidentele demonstrează necesitatea introducerii prin lege a unor teste obligatorii de siguranță pentru modelele avansate de inteligență artificială.

Cazurile semnalate de OpenAI și Anthropic reprezintă unele dintre cele mai serioase incidente raportate până acum privind comportamentul autonom al agenților AI și ar putea accelera adoptarea unor reglementări dedicate securității acestor sisteme.

BVB | Știri BVB
FONDUL PROPRIETATEA (FP) (31/07/2026)

Solicitare de convocare a AGOA Fondul Proprietatea S.A.

Sphera Franchise Group (SFG) (31/07/2026)

Perioada inchisa de tranzactionare 01.08.2026 - 30.08.2026

Premier Energy PLC (PE) (31/07/2026)

Perioada inchisa de tranzactionare 01.08.2026 - 31.08.2026

Vista Bank Bonds 2036 (VISTA36E) (31/07/2026)

Tranzactii management - art. 19 Reg. (UE) 596/2014