In un nuovo studio, il laboratorio di ricerca sull'intelligenza artificiale Anthropic ha dimostrato che diversi modelli di IA leader, non solo il proprio, sono in grado di ricattare quando vengono inseriti in scenari guidati da obiettivi ad alta autonomia. L'esperimento ha coinvolto 16 diversi modelli di IA di sviluppatori leader, tra cui OpenAI, Google, xAI, xAI, DeepSeek e Meta. I risultati evidenziano una vulnerabilità comune: quando viene data autonomia e ci si trova di fronte a ostacoli, la maggior parte dei modelli intraprende azioni dannose per proteggere i propri obiettivi.
Ultime notizie
12:36
Gianni Infantino è coinvolto in una controversia disciplinare riguardante il portiere della Repubblica Democratica del Congo ai Mondiali 2026
12:27
Il primo ministro designato Luca Niculescu: «In questi giorni stiamo elaborando il programma di governo e mi preparo alle consultazioni con i partiti parlamentari. Credo che la Romania non abbia bisogno di ripartire ogni volta da zero»
12:26
Porsche cambia strategia/ Riduce la produzione, i costi e 9.000 posti di lavoro entro il 2030
12:26
Alexandru Nazare ha discusso con due agenzie di rating e avverte che le nuove spese possono incidere sul bilancio della Romania nel 2027.
12:23
UE finanțează 40 de parteneriate școlare printr-un apel de 20 milioane EUR și pregătește Alianțele Școlare Europene pentru 2028
Vedi altre notizie