Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
17:08
Trafic dense sur les routes en direction du littoral et dans la vallée de Prahova, dimanche après-midi.
16:43
Explosion à Crocmaz, République de Moldavie : Des fragments de drone de combat découverts / Aucune victime signalée
16:15
Le Collège des Médecins de Roumanie, réaction après qu'une ambulance a été attaquée dans le département de Cluj. Ils condamnent la violence contre le personnel médical.
16:00
MAE, avertissement de voyage pour l'Espagne. Restrictions dans la Communauté valencienne le 12 août, le jour de l'éclipse solaire, en raison du risque d'incendies.
15:36
Homme arrêté à Bucarest après avoir provoqué plusieurs incendies dans la zone du Boulevard Iuliu Maniu
Voir plus d’actualités