Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
19:16
Foyer d'hépatite A à Alba Iulia : 7 enfants et un adulte infectés
19:03
Italie : Le maire de la ville de Côme interdit les vélos dans le centre historique après un accident
19:03
Warehouses De Pauw Roumanie, en collaboration avec Lamas Invest, souhaite construire deux centres de données dans le département d'Ilfov
18:52
Les autorités polonaises ont arrêté un homme ukrainien, suspecté de tentative d'assassinat sur un représentant de l'industrie de l'armement en Ukraine.
18:51
Transelectrica : Le Système Électroénergétique National a dépassé 2 500 MW de capacités de production et de stockage connectées au réseau en 2026
Voir plus d’actualités