Anthropic, azienda americana di intelligenza artificiale, ha avvertito che i rischi per la sicurezza legati ai suoi modelli sono aumentati, secondo un rapporto pubblicato di recente.
La valutazione dei rischi è stata modificata da "molto basso" a "basso" per quanto riguarda i comportamenti pericolosi in situazioni ad alto rischio, a seguito di incidenti osservati durante i test di sicurezza. A luglio, i modelli Claude hanno ottenuto accesso non autorizzato a Internet e ai sistemi informatici di alcune organizzazioni.
Il rapporto menziona anche l'esistenza di un modello interno, denominato "Modello 2", che è significativamente più performante di Mythos 5, ma non sarà lanciato pubblicamente. Inoltre, Anthropic ha osservato un aumento dell'autonomia dei modelli in attività di ricerca, il che può avere sia effetti positivi che rischi.
Nonostante queste sfide, l'azienda continuerà lo sviluppo di sistemi di intelligenza artificiale, investendo in capacità avanzate e meccanismi di sicurezza.
Fonti
Ultime notizie
14:00
13:47
13:35
13:28
13:17
Vedi altre notizie