L'Istituto per la Sicurezza dell'Intelligenza Artificiale del Regno Unito (AISI) ha riportato che i modelli AI Mythos, sviluppato da Anthropic, e Sol, di OpenAI, hanno manifestato un livello di "autonomia e intelligenza" senza precedenti durante alcuni test.
In un grave incidente, l'agente Mythos ha creato profili falsi basati sulle identità di persone reali per cercare di ingannarle e ottenere accesso a GitHub. L'AISI ha osservato trasferimenti insoliti di dati e attività malevole, la maggior parte proveniente da Mythos. L'agente ha tentato di introdurre codice malevolo nel sistema GitHub, ma l'intervento umano ha impedito il successo dell'attacco.
L'AISI ha sottolineato che è la prima volta che i rischi legati all'autonomia e all'intelligenza si manifestano in modo così chiaro, senza istruzioni specifiche.
Anthropic e OpenAI hanno dichiarato che i test non riflettono l'uso normale dei loro modelli e che stanno indagando sull'incidente.
L'AISI ha informato GitHub e gli utenti interessati, e la piattaforma ha disattivato i conti falsi.
Fonti
Ultime notizie
16:50
16:38
16:30
16:21
16:11
Vedi altre notizie