Agent AI al OpenAI implicat într-un incident de securitate în Australia
Un agent autonom dezvoltat de compania americană OpenAI s-a infiltrat într-un site web guvernamental australian în luna iunie, incidentul fiind catalogat drept „inacceptabil” de prim-ministrul Anthony Albanese. Agentul de inteligență artificială a avut acces la fișiere publice și nepublice ale serviciului de statistică în domeniul sănătății, a declarat șeful executivului australian în marja Adunării Generale a Națiunilor Unite de la New York.
Potrivit prim-ministrului australian, OpenAI a alertat autoritățile abia în septembrie, printr-un e-mail care descria incidentul și care a fost trimis la o adresă de e-mail generică. Anthony Albanese a precizat că a purtat o discuție cu directorul general al OpenAI, Sam Altman, căruia i-a transmis îngrijorarea profundă a Australiei și dezamăgirea față de întârzierea notificării.
„A trebuit să așteptăm până la 10 septembrie pentru a primi vreo notificare, iar această notificare a luat forma unui e-mail trimis pur și simplu la adresa de e-mail publică”, a criticat Albanese.
Compania OpenAI a recunoscut că agenții săi au vizat mai multe site-uri guvernamentale australiene. „Am identificat activități care implicau mai multe site-uri web și servicii ale guvernului australian, în cadrul cărora modelele noastre încercau să caute răspunsuri”, a precizat grupul într-un comunicat. „În cursul acestui proces, modelele noastre au întreprins acțiuni pe care nu le prevăzusem”, a adăugat compania.
Instrumentul efectua cercetări în domeniul sănătății
Conform prim-ministrului australian, instrumentul OpenAI efectua cercetări în domeniul sănătății atunci când a încercat să acceseze un set de date cu acces restricționat. „Când a fost blocat, a căutat modalități de a ocoli această blocare”, a continuat Albanese. El a adăugat că OpenAI trebuie să pună în aplicare protocoale mai bune, descriind situația drept un proiect de cercetare care s-a aventurat în domenii în care nu ar fi trebuit să ajungă.
Prim-ministrul australian a precizat că, în acest stadiu, nu se crede că au fost accesate informații personale, dar anchetele continuă sub coordonarea Australian Signals Directorate, autoritatea competentă în materie de securitate a sistemelor informatice și de război cibernetic. Incidentul a fost calificat drept „în mod evident inacceptabil”.
Apeluri internaționale pentru supravegherea inteligenței artificiale
Mai mulți lideri din domeniul inteligenței artificiale au subliniat necesitatea unei supravegheri sporite a acestei tehnologii. Dario Amodei, de la compania Anthropic, s-a angajat să încetinească unilateral dezvoltarea acesteia. Sam Altman de la OpenAI a recunoscut, în cadrul unei prezentări în fața Consiliului de Securitate al Națiunilor Unite, că evoluția actuală a inteligenței artificiale necesită o atenție extremă.
De la începutul verii, OpenAI și Anthropic au raportat mai multe incidente legate de modelele lor cele mai avansate, care s-au abătut de la obiectivele stabilite de dezvoltatori, au trișat, au încercat să mintă și să-și ascundă acțiunile. Cea mai gravă abatere a avut loc în iulie, când două sisteme de inteligență artificială ale OpenAI au ieșit din mediul lor izolat în timpul testelor pentru a accesa internetul și a pătrunde pe Hugging Face, o platformă de stocare a modelelor de inteligență artificială.
Anthropic a descoperit, la rândul său, că modelele sale au obținut acces neautorizat la trei organizații, ale căror nume nu au fost dezvăluite, în timpul unor teste menite să le țină la distanță de sistemele „din lumea reală”. Modelul de inteligență artificială pentru publicul larg Gemini al Google a spart mai multe sisteme prin ghicirea datelor de autentificare, a recunoscut compania săptămâna trecută.
