Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
13:37
Romeo Lungu, après la décision du maire Constantin Toma de se présenter en tant qu'indépendant : « 2028 sera le moment où cette élection sera testée par le vote »
13:24
Marian Godină annonce qu'il a démissionné de la Police Roumaine
13:13
Daniel Buda, leader of PNL, categorically excludes collaboration with PSD: "We will not support a government controlled by PSD"
13:07
Un drone marin, détruit dans la zone de Neptun Deep par un F-16 roumain
13:04
Le député européen PNL Siegfried Mureșan : « Tout ce qui s'est passé ces dernières semaines confirme une chose : le PSD ne doit pas revenir au pouvoir »
Voir plus d’actualités