Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
22:59
Le Pentagone demande à l'industrie de la défense américaine d'augmenter rapidement la production et la livraison d'armement.
22:45
CNAS révèle des fraudes dans le système de santé : Consultations fictives pour des patients vulnérables : « Ils ont oublié de demander si les patients sont encore en vie »
22:38
Un dépôt de fournitures médicales de l'OMS à Dnipro, Ukraine, a été attaqué et détruit
22:29
Botoșani : Femme arrêtée après avoir tué son concubin et l'avoir enterré dans la cour de la maison
22:05
Elon Musk refuse l'utilisation de Starlink par l'Ukraine pour des attaques en Russie
Voir plus d’actualités