Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
14:54
Sam Altman décrit Emmanuel Macron comme étant « extrêmement attentif » à l’évolution de l’intelligence artificielle
14:47
La coalition militaire dirigée par l’Arabie saoudite a rejoint lundi l’offensive gouvernementale au Yémen contre les rebelles houthis soutenus par l’Iran
14:35
CFA Roumanie prévoit une croissance économique de seulement 0 à 0,5 % en 2027
14:34
Allemagne : le chef du Service fédéral de renseignement extérieur avertit que le pays risque un conflit violent avec la Russie, dans un contexte d’intensification des attaques hybrides attribuées à Moscou
14:29
Nicușor Dan a refusé la nationalité française, bien qu’elle lui ait été proposée pendant ses études en France
Voir plus d’actualités