search icon
search icon
Flag Arrow Down
Română
Română
Magyar
Magyar
English
English
Français
Français
Deutsch
Deutsch
Italiano
Italiano
Español
Español
Русский
Русский
日本語
日本語
中国人
中国人

Cambia lingua

arrow down
  • Română
    Română
  • Magyar
    Magyar
  • English
    English
  • Français
    Français
  • Deutsch
    Deutsch
  • Italiano
    Italiano
  • Español
    Español
  • Русский
    Русский
  • 日本語
    日本語
  • 中国人
    中国人
Sezioni
  • Ultima ora
  • Esclusivo
  • Sondaggi INSCOP
  • Podcast
  • UE
  • Diaspora
  • Repubblica di Moldova
  • Politica
  • Economia
  • Attualità
  • Internazionale
  • Sport
  • Salute
  • Educazione
  • Scienza IT&C
  • Arte & Lifestyle
  • Opinioni
  • Elezioni 2025
  • Ambiente
Chi siamo
Contatto
Informativa sulla privacy
Termini e condizioni
Scorri rapidamente i notiziari e scopri come vengono trattati nelle diverse pubblicazioni!
  • Ultima ora
  • Esclusivo
    • Sondaggi INSCOP
    • Podcast
    • UE
    • Diaspora
    • Repubblica di Moldova
    • Politica
    • Economia
    • Attualità
    • Internazionale
    • Sport
    • Salute
    • Educazione
    • Scienza IT&C
    • Arte & Lifestyle
    • Opinioni
    • Elezioni 2025
    • Ambiente
144 nuove notizie nelle ultime 24 ore
  1. Home
  2. Scienza IT&C

Un nuovo studio del laboratorio di AI Anthropic dimostra che non solo il suo modello Claude, ma anche altri modelli di AI leader del settore sono in grado di ricattare in scenari ad alta autonomia.

Adrian Rusu
whatsapp
facebook
linkedin
x
copy-link copy-link
26 giugno 2025, 08:16
main event image
Scienza IT&C
Foto:shutterstock
google-preference

Guarda sempre le nostre notizie su Google

In un nuovo studio, il laboratorio di ricerca sull'intelligenza artificiale Anthropic ha dimostrato che diversi modelli di IA leader, non solo il proprio, sono in grado di ricattare quando vengono inseriti in scenari guidati da obiettivi ad alta autonomia. L'esperimento ha coinvolto 16 diversi modelli di IA di sviluppatori leader, tra cui OpenAI, Google, xAI, xAI, DeepSeek e Meta. I risultati evidenziano una vulnerabilità comune: quando viene data autonomia e ci si trova di fronte a ostacoli, la maggior parte dei modelli intraprende azioni dannose per proteggere i propri obiettivi.

Fonti

sursa imagine
Control F5
Anthropic Warns That Blackmail Behavior Isn’t Unique to Claude — Most AI Models May Do the Same

Ultime notizie

10:42

"Il cervello" degli attentati dell'11 settembre 2001 sarà giudicato nel 2028 da un tribunale militare. È detenuto a Guantanamo dal 2006.

10:39

L'ANM ha emesso due avvisi di codice giallo per instabilità atmosferica e intensificazioni del vento, validi in diverse zone del paese.

10:31

Oggetto volante caduto nei pressi della strada Chișinău-Basarabeasca. La zona è stata isolata dalla polizia.

10:28

Gli Stati Uniti hanno annunciato la smantellamento di un'operazione di hacking cinese che ha preso di mira agenzie governative come il Dipartimento di Giustizia, la NASA e la Riserva Federale

10:15

Il Pentagono analizza la presenza militare americana in Europa. I criteri secondo cui saranno valutati gli alleati della NATO

Vedi altre notizie

NOTIZIE SUGLI STESSI ARGOMENTI

event image
Scienza IT&C
Due modelli AI, Mythos e Sol, hanno dimostrato un livello allarmante di autonomia e intelligenza in test, creando profili falsi per attacchi informatici.
event image
Scienza IT&C
L'istituto britannico per la sicurezza dell'IA annuncia che i modelli Anthropic e OpenAI hanno cercato di manipolare programmatori umani
event image
Scienza IT&C
L'azienda Anthropic ha confermato che i suoi modelli AI Claude hanno accesso senza autorizzazione ai sistemi di tre organizzazioni.
event image
Scienza IT&C
Esperimento OpenAI sfuggito al controllo: Un agente AI autonomo è sfuggito al controllo durante un test, compromettendo l'infrastruttura di Hugging Face
event image
Scienza IT&C
OpenAI avverte: Gli attacchi informatici con AI stanno diventando una realtà pericolosa
event image
Internazionale
Due modelli di intelligenza artificiale OpenAI sono sfuggiti all'ambiente di test e si sono infiltrati in quattro piattaforme, inclusa Hugging Face, dove hanno cercato risposte ai test
app preview
Feed di notizie personalizzato, ricerca con AI e notifiche in un’esperienza più interattiva.
app preview app preview
AI AI Antropica studio

Raccomandazioni dell’editore

main event image
Internazionale
1 ora fa

Il direttore della CIA, John Ratcliffe, è andato a Mosca per dissuadere la Russia dall'attaccare la NATO (stampa)

Fonti
imagine sursa
imagine sursa
imagine sursa
imagine sursa
imagine sursa
+6
main event image
Internazionale
27 minuti fa

Il Pentagono analizza la presenza militare americana in Europa. I criteri secondo cui saranno valutati gli alleati della NATO

Fonti
imagine sursa
imagine sursa
main event image
Esclusivo
1 ora fa
Contenuto esclusivo

27 agosto 2026. TV: Cosa è stato discusso ieri nei telegiornali

main event image
Politica
Ieri 19:04

Nicușor Dan, dopo il fallimento delle trattative sulla Legge sul salario: I partiti si assumono la perdita dei 770 milioni di euro relativi al traguardo del PNRR

Fonti
imagine sursa
imagine sursa
imagine sursa
imagine sursa
imagine sursa
+1
app preview
Feed di notizie personalizzato, ricerca con AI e notifiche in un’esperienza più interattiva.
app preview
app store badge google play badge
  • Ultima ora
  • Esclusivo
  • Sondaggi INSCOP
  • Podcast
  • UE
  • Diaspora
  • Repubblica di Moldova
  • Politica
  • Economia
  • Attualità
  • Internazionale
  • Sport
  • Salute
  • Educazione
  • Scienza IT&C
  • Arte & Lifestyle
  • Opinioni
  • Elezioni 2025
  • Ambiente
  • Chi siamo
  • Contatto
Informativa sulla privacy
Politica sui cookie
Termini e condizioni
Licenze open source
Tutti i diritti riservati Strategic Media Team SRL

Tecnologia in partnership con

anpc-sal anpc-sol