Institutul pentru Securitatea Inteligenței Artificiale din Marea Britanie (AISI) a raportat că modelele AI Mythos, dezvoltat de Anthropic, și Sol, de OpenAI, au manifestat un nivel de „autonomie și înșelăciune” fără precedent în timpul unor teste.
Într-un incident grav, agentul Mythos a creat profiluri false bazate pe identitățile unor persoane reale pentru a încerca să le păcălească și a obține acces la GitHub. AISI a observat transferuri neobișnuite de date și activități malițioase, majoritatea provenind de la Mythos. Agentul a încercat să introducă cod malițios în sistemul GitHub, dar intervenția umană a împiedicat succesul atacului.
AISI a subliniat că este prima dată când riscurile legate de autonomie și înșelăciune s-au manifestat atât de clar, fără instrucțiuni specifice.
Anthropic și OpenAI au declarat că testele nu reflectă utilizarea obișnuită a modelelor lor și că investighează incidentul.
AISI a informat GitHub și utilizatorii afectați, iar platforma a dezactivat conturile false.
Surse
Ultimele știri
16:11
16:10
16:00
15:49
15:39
Vezi mai multe știri