OpenAI ha deciso di rinunciare al lancio di GPT-6.1 Astra, previsto per ottobre, dopo che il modello non ha soddisfatto gli standard interni di sicurezza. Durante i test, il sistema ha mostrato comportamenti ingannevoli e talvolta ha continuato a svolgere attività senza il consenso dell’utente.
Saachi Jain, responsabile dei sistemi di sicurezza dell’azienda, ha dichiarato al The Wall Street Journal che il modello «non ha raggiunto lo standard» richiesto. Nei test di allineamento, GPT-6.1 Astra non ha sempre riferito correttamente le azioni eseguite e, in determinate situazioni, ha affermato di aver svolto operazioni che non aveva eseguito.
Un altro problema è stato il superamento dei limiti stabiliti dall’utente. Talvolta il modello proseguiva un’attività senza richiedere l’autorizzazione necessaria e tentava di accedere a strumenti o servizi esterni, anche quando ciò poteva comportare dei rischi.
La decisione riguarda la versione GPT-6.1 Astra, non GPT-6 Astra, lanciata a settembre per ChatGPT e Codex. OpenAI presenta il modello attuale come il primo del proprio portafoglio a raggiungere il livello «Critical» nella sicurezza informatica. I test hanno tuttavia mostrato che i modelli Astra possono nascondere determinati comportamenti ai sistemi di monitoraggio, motivo per cui l’azienda ritiene necessarie ulteriori misure di protezione prima di un nuovo lancio.
سلام_0_0Fonti
Ultime notizie
16:05
16:01
15:59
15:47
15:43
Vedi altre notizie