Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
17:44
Un fragment de drone a été apporté par les vagues sur la plage d'Olympie, étant observé par un sauveteur qui a alerté les autorités. Les spécialistes vont analyser l'objet.
17:32
David Popovici a souligné l'importance de la collaboration avec un psychologue pour gérer efficacement la pression compétitive et revenir progressivement à un état de relaxation après les émotions de la compétition.
17:22
Fenway Sports Group a vendu une participation minoritaire à Liverpool à un consortium dirigé par Jeff Bezos, qui inclut aussi d'autres investisseurs.
17:12
Le niveau de l'eau sur le fleuve Rhin a chuté à 6 centimètres, un minimum record, affectant le transport de marchandises. Les entreprises redirigent les transports vers des camions et des trains.
17:01
Ulrich Siegmund, homme politique du AfD, a été nommé 'l'homme le plus dangereux d'Allemagne' par le magazine Spiegel, quelques semaines avant les élections en Saxe-Anhalt.
Voir plus d’actualités