Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
19:12
Deutsche Telekom achète l'opérateur Fiberhost et le fournisseur Inea en Pologne pour environ 1 milliard d'euros, consolidant ainsi sa position sur le marché des télécommunications.
19:06
La ceinture nord de Focșani sera ouverte à la circulation à partir de mardi, 25 août, offrant une connexion directe entre DN2D et l'autoroute A7.
18:58
Le maire de Buzău a annoncé qu'il ne se représentera pas pour un nouveau mandat au sein du PSD / Il envisage une candidature indépendante.
18:54
Une enquête pour mort suspecte est en cours dans le sud de la France, après que le corps de l'influenceuse Sonia Bellina a été trouvé dans un vignoble.
18:53
L'UE condamne l'extension des sanctions des États-Unis contre la Cour pénale internationale
Voir plus d’actualités