Încă de la momentul în care a anunțat că urmează să lanseze GPT-6.1 Astra, OpenAI a recunoscut că acest model tinde să își ascundă acțiunile și să șteargă urmele a ceea ce face, iar decizia de a anula lansarea comenrcială a acestuia nu a venit cu o explicație mult mai clară.

Sistemul de inteligență artificială, despre care OpenAI spusese că îndeplinește singur sarcini, precum navigarea pe web și utilizarea aplicațiilor, “nu îndeplinește pe deplin standardele de siguranță ale companiei și a eșuat în ceea ce privește respectarea domeniului de aplicare și autorizație și modul în care comunică utilizatorului despre tipul de muncă efectuată. Vrem să ne asigurăm că dezvoltarea modelului nostru este sigură, indiferent dacă este în cadrul companiei sau atunci când îl livrăm utilizatorilor. Dar atunci când îl livrăm utilizatorilor, avem un standard extrem de ridicat în ceea ce privește siguranța și alinierea”, a declarat pentru BBC Saachi Jain, șefa sistemelor de siguranță la OpenAI.

Modelul agentic emblematic GPT-6 Astra a fost prezentat la începutul lunii septembrie și a stârnit dezbateri serioase privind faptul că acesta ar fi începutul erei AGI, un nivel de la care inteligența artificială o depășește pe cea umană la toate nivelurile și pentru toate sarcinile. Compania l-a prezentat ca fiind un model specializat în “raționament complex și executarea autonomă a sarcinilor, rezultat al unor ani de cercetare și mize mari”, dar a precizat încă de atunci că Astra “este mai predispus să ascundă sau să deghizeze intenționat metodele sale de raționare, ceea ce face mai dificilă evaluarea ulterioară a tehnicilor sale de către oameni”.

La câteva zile după lansare, chiar Jakub Pachocki, cercetătorul șef al OpenAI, cerea “prudență extremă” și scria pe blogul oficial al companiei că “nimeni nu este pregătit pentru consecințele unei creșteri rapide și continue a inteligenței artificiale”. Avertismentul său a stârnit numeroase critici, în condițiiile în care chiar OpenAI pare a avea cele mai multe probleme de siguranță.

Odată cu anularea lansării Astra, OpenAI a emis, de asemenea, o actualizare privind incidentele care au avut loc în iunie, dar care nu au fost făcute publice decât săptămâna trecută, în care modelele sale au accesat site-uri web și sisteme guvernamentale (australiene) fără a fi fost programați sau autorizați să facă acest lucru. Compania a recunoscut că, deși a devenit încă din august conștientă că agenții săi AI au spart mai multe site-uri guvernamentale din Australia, abia în septembrie a trimis o notificare în acest sens. Prim-ministrul australian, care a anunțat prima dată incidentele săptămâna trecută, de la tribuna ONU, a precizat că OpenAI a trimis un e-mail generic, în loc să ia contact direct cu oficialii statului.

Luni, Nvidia a lansat un set de instrumente de siguranță software pentru platformele autonome de inteligență artificială despre care susține că ar fi putut preveni atacul cibernetic de la Hugging Face. Șeful Nvidia, Jensen Huang, a respins în mare parte apelurile pentru reglementări mai stricte privind inteligența artificială, argumentând că agenții AI scăpați de sub control ar fi “o problemă de inginerie care poate fi rezolvată”. Nvidia are interes direct în achizițiile făcute de companiile AI de centre de date și a cumpărat Hugging Face (pentru 12,9 miliarde de dolari) la începutul acestei luni.

Ieri, șeful Nvidia a primit o replică chiar de la Papa Leon al XIV-lea, care și-a exprimat scepticismul față de opiniile lui Huang, dar și față de instrumentul Nvidia. Suveranul Pontif a spus că “este același om care spune că nu ar trebui să existe limite și nicio reglementare guvernamentală”. Anterior, Papa a avertizat că există riscul “pierderii umanității noastre în fața mașinilor”.

Surse: WSJ, BBC

Echipa Biziday nu a solicitat și nu a acceptat nicio formă de finanțare din fonduri guvernamentale. Spațiile de publicitate sunt limitate, iar reclama neinvazivă.

Dacă îți place ce facem, poți contribui tu pentru susținerea echipei Biziday.

Susține echipa Biziday