Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
09:29
Le prince Harry et sa femme Meghan prévoient de retourner au Royaume-Uni pour vivre dans une résidence privée (presse britannique)
09:15
Plus de 20 000 de Russes ont traversé la frontière russo-géorgienne au cours des dernières 24 heures, en raison des craintes liées à la mobilisation forcée en guerre.
09:09
EXCLUSIF | 20 Août 2026. Tendances dans les recherches en ligne / dernières 24 heures
08:58
Un hélicoptère touristique s'est écrasé dans le centre du Kenya. Le chef du service de renseignement de l'Équateur, parmi les victimes.
08:45
Un drone militaire Shahed-136 a pénétré de manière non autorisée dans l'espace aérien de la République de Moldavie, par le village d'Etulia, Găgăuzia
Voir plus d’actualités