Un agent de inteligență artificială dezvoltat de OpenAI a obținut acces neautorizat la un site al guvernului australian, a declarat premierul Anthony Albanese, incidentul ridicând noi întrebări cu privire la riscurile generate de sistemele AI din ce în ce mai autonome, potrivit CNBC.
Incidentul are loc în contextul în care companiile de inteligență artificială dezvoltă tot mai mult agenți capabili să execute sarcini în mai mulți pași și să interacționeze cu site-uri și programe externe cu o implicare umană mai redusă. Această evoluție ridică întrebări privind modul în care dezvoltatorii pot preveni comportamentele neașteptate pe măsură ce tehnologia devine mai autonomă.
Incidentul s-a produs pe 18 iunie și a implicat un agent OpenAI care a accesat portalul serviciului de raportare a statisticilor Medicare, administrat de Services Australia, a declarat Albanese.
Potrivit premierului, agentul OpenAI a accesat atât fișiere publice, cât și nepublice. Se consideră că nu au fost accesate informații personale, însă este în desfășurare o investigație criminalistică informatică.
Portalul conține informații Medicare nesensibile, inclusiv statistici privind cheltuielile.
Albanese a declarat că a discutat cu CEO-ul OpenAI, Sam Altman, pentru a-i transmite „îngrijorarea extremă” a Australiei cu privire la incident și a criticat timpul îndelungat de care compania a avut nevoie pentru a informa guvernul.
Compania de inteligență artificială a notificat autoritățile australiene pe 10 septembrie, la aproape trei luni după incidentul din iunie.
OpenAI a precizat că activitatea s-a produs în timpul unei evaluări interne, în timp ce modelele sale încercau să găsească răspunsuri și date statistice despre Australia.
„În cursul acestui proces, modelele noastre au întreprins acțiuni pe care nu le-am intenționat”, a declarat pentru CNBC un purtător de cuvânt al OpenAI.
Compania a afirmat că analiza sa nu a identificat dovezi că ar fi fost accesate dosare ale pacienților. Potrivit purtătorului de cuvânt, informațiile accesate au inclus statistici agregate privind sănătatea și denumiri ale unor fișiere interne.
OpenAI a precizat că activitatea a avut loc în iunie, însă compania nu a aflat despre aceasta decât în august, în timpul unei analize aflate în desfășurare asupra a ceea ce numește „activitate nealiniată a modelelor” („misaligned model activity”).
Compania a notificat Services Australia pe 10 septembrie, după ce a investigat ce informații fuseseră accesate.
OpenAI a precizat că analiza generală a incidentului continuă.
Alte sisteme OpenAI ar fi încercat să acceseze sisteme fără să fi primit instrucțiuni în acest sens
Înaintea incidentului din Australia, sistemele AI ale OpenAI au încercat să pătrundă într-o bibliotecă digitală a University of New Mexico și în Data USA, o platformă care furnizează date publice privind ocuparea forței de muncă și educația în Statele Unite, fără să fi primit instrucțiuni în acest sens, potrivit unui articol publicat de The New York Times.
Cel mai important incident de până acum s-a produs în iulie, când modelele OpenAI au ocolit mecanismele de control concepute pentru a le izola de internet și au compromis părți ale infrastructurii interne de cercetare a companiei, precum și sisteme aparținând platformei pentru dezvoltatori Hugging Face.