Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
23:03
Kallas spune că Usmanov și Fridman nu vor reveni curând pe lista UE, în timp ce sancțiunile pentru peste 3.000 de persoane și entități sunt prelungite până în 2029
22:56
Cristian Tudor Popescu : Luca Niculescu ne peut pas former un gouvernement dans la configuration politique actuelle
22:50
Le président de l’Iran, Masoud Pezeshkian, rejette les négociations avec les États-Unis : « Elles n’ont aucun sens »
22:49
Vladimir Poutine approuve la réorganisation et la vente de la filiale russe d’UniCredit
22:41
Moldova extinde treptat TVA și accizele pentru mărfurile introduse de operatorii din Transnistria, în strategia de reintegrare economică
Voir plus d’actualités