Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
23:05
Le seul parti anti-guerre en Russie a été exclu de la course électorale
23:00
Plus de 1 200 Palestiniens ont été tués à Gaza depuis l'entrée en vigueur du cessez-le-feu avec Israël en octobre 2025. Des experts de l'ONU avertissent sur le génocide continu.
22:55
La Cour d'Appel d'Alba Iulia a rejeté la proposition de détention préventive du procureur Radu George Bucurică, accusé d'infractions liées à la détention illégale et à l'utilisation d'un pistolet létal.
22:53
Diana Buzoianu a annoncé que les estimations pour le fonctionnement de l'Unité 2 de Cernavodă ont été révisées à la baisse : « Nous sommes dans un pronostic beaucoup plus sombre qu'hier »
22:47
Ionel Bogdan (PNL) accuse la désinformation sur TikTok pour l'attaque contre une ambulance et demande l'audition du président de l'ANCOM au Parlement.
Voir plus d’actualités