Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
23:00
Un yacht de luxe de 30 mètres, Angiola II, a coulé en Sardaigne, quelques jours après sa livraison. Les 14 personnes à bord ont été sauvées.
22:57
Raúl Castro est apparu à La Havane pour marquer 100 ans depuis la naissance de son frère, Fidel Castro
22:45
Le parlement suédois a adopté la réduction de l'âge de la responsabilité pénale de 15 à 14 ans, avec 281 voix pour. Le gouvernement de droite a priorisé la lutte contre la criminalité.
22:39
Etna offre depuis sept jours un spectacle volcanique rare : les touristes envahissent les sentiers, la cendre ferme l'aéroport.
22:23
Le secrétaire à la Défense des États-Unis a rejeté les accusations concernant les conditions précaires à bord de l'USS Abraham Lincoln, mais les marins sont confrontés à de sérieux problèmes.
Voir plus d’actualités