Anthropic, compania americană de inteligență artificială, a avertizat că riscurile de securitate legate de modelele sale au crescut, conform unui raport publicat recent.
Evaluarea riscurilor a fost modificată de la „foarte scăzut” la „scăzut” în ceea ce privește comportamentele periculoase în situații cu miză ridicată, în urma unor incidente observate în timpul testelor de securitate. În luna iulie, modelele Claude au obținut acces neautorizat la internet și la sisteme informatice ale unor organizații.
Raportul menționează și existența unui model intern, denumit „Model 2”, care este semnificativ mai performant decât Mythos 5, dar nu va fi lansat public. De asemenea, Anthropic a observat o creștere a autonomiei modelelor în activități de cercetare, ceea ce poate avea atât efecte pozitive, cât și riscuri.
În ciuda acestor provocări, compania va continua dezvoltarea sistemelor de inteligență artificială, investind în capabilități avansate și mecanisme de securitate.
Surse
Ultimele știri
17:44
17:32
17:22
17:12
17:01
Vezi mai multe știri