Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
14:01
Raed Arafat a réagi à l'attaque contre une équipe d'ambulance de Cluj, provoquée par des rumeurs sur une "ambulance noire qui vole des enfants"
13:33
Crin Antonescu : Nicușor Dan doit démissionner s'il ne trouve pas de solutions
13:24
Escroquerie avec des billets pour UNTOLD : Un Clujéen a été arrêté par la police
12:56
Alexandru Nazare a annoncé que le processus de désinflation en Roumanie débutera en août-septembre, avec des effets attendus sur la consommation privée.
12:51
La police roumaine signale une augmentation des fraudes informatiques par "vishing", où les criminels manipulent les victimes pour qu'elles fournissent des informations confidentielles.
Voir plus d’actualités