| Romana
Anthropic raportează al patrulea incident cibernetic care implică o versiune timpurie a Claude
Anthropic spune că a încheiat un acord cu METR pentru a efectua o investigație independentă asupra acestor incidente.
Anthropic raportează al patrulea incident cibernetic care implică o versiune timpurie a Claude
Companiile de inteligență artificială sunt atent monitorizate din cauza incidentelor de evadare a IA, inclusiv a unor cazuri în care agenți IA au fost eliberați neintenționat pe internetul deschis. / Reuters Archive

Compania Anthropic a informat că a identificat un al patrulea incident de securitate cibernetică în care a fost implicată o versiune timpurie a modelului său de inteligență artificială Claude.

Într-o postare publicată miercuri pe blogul oficial, compania a precizat că incidentul a avut loc în luna ianuarie și a implicat o versiune timpurie a modelului Claude Opus 4.6. Anthropic a notificat toate părțile afectate, însă a refuzat să ofere detalii suplimentare.

„După descoperirea acestui incident, ne-am extins căutările la aproximativ 481 de milioane de transcrieri – o plasă intenționat largă, care a inclus toate transcrierile de la echipa noastră de testare Frontier Red Team, numeroase evaluări non-cibernetice, medii de învățare prin consolidare (RL), jurnale ale subagenților și altele”, a menționat Anthropic în comunicat.

„Am semnat un acord cu METR pentru a efectua o investigație independentă a acestor incidente. Acordul nostru le acordă celor de la METR acces extins, inclusiv la transcrieri din afara intervalului în care s-au produs incidentele, precum și la angajații Anthropic, cărora le va fi permis să partajeze informații confidențiale.”

În iulie, Anthropic dezvăluise că unele dintre modelele sale Claude reușiseră să pătrundă în sistemele a trei companii în timpul unor teste de securitate cibernetică.

Companiile din domeniul inteligenței artificiale se confruntă cu o atenție tot mai riguroasă din cauza incidentelor de tip „breakout” (evadare a sistemelor IA), inclusiv a cazurilor în care agenții autonomi au fost scăpați accidental pe internetul deschis.

Săptămâna trecută, agenția de presă Reuters a relatat că agenți autonomi ai OpenAI au preluat controlul asupra unui wiki în limba germană și a altor site-uri – un incident pe care OpenAI a ales să nu-l dezvăluie până când agenția de presă l-a făcut public.