Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.
Dernières actualités
20:36
Mircea Abrudean, le président du Sénat, annonce une session extraordinaire au Parlement entre le 24 et le 26 août, dédiée aux réformes du PNRR
20:20
Le syndicat des employés travaillant avec des fonds européens conteste la loi sur les salaires et accuse le ministre Pîslaru : « Son propre ministre frappe les employés dont il se vante des résultats ! »
20:05
Les co-fondateurs de La Mița Biciclista ont présenté leurs excuses après les réactions négatives suscitées par une vidéo considérée comme élitiste. Edmond Niculușcă : « Nea Mihai, je vous demande pardon ! »
19:59
Traian Băsescu a critiqué sur Digi24 le projet de la nouvelle Loi sur la rémunération, affirmant que le mélange du salaire avec les primes ne sera pas accepté par la Commission européenne.
19:53
Un Roumain de 35 ans a été arrêté en Roumanie, accusé de viol sur une mineure de 12 ans, disparue d'Espagne. La mineure a fui de chez elle pour être avec lui.
Voir plus d’actualités