| Romana
OpenAI renunță la lansarea viitorului model pe fondul îngrijorărilor tot mai mari privind siguranța
OpenAI a decis să nu lanseze modelul GPT-6.1 Astra din cauza preocupărilor sporite legate de siguranța IA, șeful departamentului de siguranță afirmând că modelul „nu a îndeplinit pe deplin criteriile” privind domeniul de aplicare și autorizarea.
OpenAI renunță la lansarea viitorului model pe fondul îngrijorărilor tot mai mari privind siguranța
GPT-6.1 Astra urma să își facă debutul în ChatGPT și Codex în octombrie. / Reuters arhiv

OpenAI renunță la lansarea GPT-6.1 Astra, un model de inteligență artificială de generație următoare planificat pentru debut în octombrie, din cauza îngrijorărilor legate de siguranță ridicate de cercetători în timpul testelor interne, potrivit Wall Street Journal.

Modelul, care urma să fie integrat în ChatGPT și Codex, a fost conceput pentru a gestiona sarcini mai complexe fără asistență umană, potrivit raportului.

La începutul lunii, directorul executiv al Anthropic, Dario Amodei a făcut un apel către industria de profil să încetinească ritmul de dezvoltare a modelelor de IA de ultimă generație, pentru a permite măsurilor de siguranță să țină pasul, o poziție susținută de Sam Altman, directorul general al OpenAI, și de Elon Musk, directorul general al SpaceX.

Responsabila pentru securitate a companiei-mamă a ChatGPT, Saachi Jain, a declarat pentru Wall Street Journal luni că Astra nu a îndeplinit standardele companiei la testele de aliniere, care evaluează dacă un sistem urmează intențiile umane.

Modelul a manifestat mai multă înșelăciune decât predecesorul său, inclusiv uneori nereușind să dezvăluie în mod corect acțiunile pe care le-a întreprins sau nu le-a întreprins, se arată în raport.

De asemenea, a avut probleme cu „autorizarea scopului”, continuând cu sarcini fără a solicita permisiunea utilizatorului și, uneori, încercând să folosească instrumente sau servicii externe când acest lucru ar fi putut fi nesigur.

Decizia vine înaintea conferinței OpenAI dedicate dezvoltatorilor, care va avea loc la San Francisco, unde compania a prezentat anterior produse destinate dezvoltatorilor de software.

Acest lucru survine la câteva luni după ce OpenAI a dezvăluit că unul dintre agenții săi de IA a spart din greșeală site-ul Hugging Face.

În cea mai recentă dezvăluire, OpenAI a declarat că agenții săi au scurs 53 de imagini aparținând utilizatorilor ChatGPT.

Compania nu a precizat dacă imaginile erau generate de inteligența artificială sau reprezentau persoane reale, nici când au fost postate.

Săptămâna trecută, The New York Times a relatat că agenții necontrolați ai OpenAI au interacționat într-un mod neobișnuit, în această vară, cu site-urile Departamentului Comerțului al SUA și ale Comisiei pentru Valori Mobiliare și Burse, fără ca compania să aibă cunoștință de acest lucru.

OpenAI a spus că a notificat agențiile guvernamentale în ultimele săptămâni.

Incidentele recente sporesc îngrijorările legate de agenții autonomi de inteligență artificială, care pot îndeplini sarcini și pot interacționa cu sisteme externe cu implicare umană limitată, și subliniază dificultățile companiilor în a urmări comportamentul acestora.