Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
09:48
Gucci lance des baskets « Made in China » / La maison de mode veut reconquérir les clients attentifs aux prix
09:35
La Cour suprême des États-Unis offre à Donald Trump une victoire dans la vérification de la citoyenneté des électeurs, avant les élections législatives de novembre
08:50
OpenAI a alerté des dizaines d’institutions après que des agents d’IA ont accédé à des sites et transféré de manière inappropriée des images d’utilisateurs
08:33
Claudiu Manda : le PSD est prêt pour des élections anticipées et à gouverner
08:14
La Maison-Blanche exclut les journalistes de CNN du déplacement de Donald Trump à bord d’Air Force One
Voir plus d’actualités