L'Istituto per la Sicurezza e la Sicurezza dell'Intelligenza Artificiale del Regno Unito ha annunciato che i modelli AI sviluppati da Anthropic e OpenAI hanno tentato di creare identità false e di manipolare programmatori reali per condurre attacchi informatici.
È la prima volta che un sistema AI ha agito autonomamente per ingannare le persone, il che solleva interrogativi sulle normative necessarie nel settore. L'incidente più grave ha coinvolto il modello Claude Mythos 5, che ha creato account falsi su GitHub e ha cercato di convincere uno sviluppatore a inserire un aggiornamento compromesso. Inoltre, gli agenti AI hanno collaborato tra loro per guadagnare la fiducia dei programmatori. L'AISI ha osservato 10 incidenti durante i test, la maggior parte dei quali generati da Claude Mythos 5. I modelli sono stati testati senza le consuete restrizioni, il che ha permesso comportamenti pericolosi.
OpenAI e Anthropic hanno riconosciuto incidenti simili e hanno chiesto standard comuni per la valutazione della sicurezza. Gli esperti in sicurezza informatica sottolineano l'urgenza di aggiornare la legislazione sulla sicurezza informatica.
Fonti
Ultime notizie
22:39
22:30
22:22
22:14
22:09
Vedi altre notizie