Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
21:43
Raphaël Glucksmann se présentera aux élections présidentielles en France en 2027
21:20
Quelques centaines de personnes se sont rassemblées sur la Place de la Victoire à Timișoara pour soutenir le maire Dominic Fritz
21:12
Le Premier ministre par intérim Ilie Bolojan, sur la loi sur les salaires : « Cette proposition doit être faite de telle sorte qu'elle puisse être supportée par l'économie roumaine à partir du budget de l'État »
21:02
Le Premier ministre par intérim Ilie Bolojan critique "l'amendement Fritz" de la Loi sur l'Intégrité : "Voter un jalon PNRR ne signifie pas l'utiliser comme un bâton politique."
20:54
Ilie Bolojan a critiqué les affirmations de l'ancien ministre Ivan concernant la déconnexion des consommateurs industriels du Système Énergétique National, soulignant que les notifications font partie d'une procédure légale.
Voir plus d’actualités