Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
10:37
Moldova, printre exportatorii mai expuși dacă UE înăsprește limitele pentru reziduurile pesticidelor
10:29
Șoferul care a provocat accidentul mortal în Brașov a fost reținut pentru 24 de ore. Poliția: Știa că are epilepsie și a întrerupt tratamentul
10:15
14 août 2026. TV : Qu'est-ce qui a été discuté hier soir sur les chaînes d'information
10:08
L'EPPO enquête sur une possible fraude de 7 millions d'euros dans 29 projets informatiques en Roumanie
10:06
INS : Le produit intérieur brut, au deuxième trimestre 2026, est resté inchangé en termes réels par rapport au premier trimestre 2026, mais a enregistré une baisse de 0,4 % par rapport au même trimestre de l'année 2025.
Voir plus d’actualités