Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
19:34
La Pologne et les pays baltes avertissent que la Russie pourrait préparer des attaques sous "drapeau faux" en utilisant des drones ukrainiens.
19:26
Incendie dans une usine de munitions en Bulgarie, après qu'un camion-citerne a été pris par les flammes. 300 travailleurs ont été évacués, et les autorités n'ont pas signalé de victimes.
19:09
230 migrants sont arrivés au Royaume-Uni après avoir traversé la Manche dans une seule embarcation, établissant un nouveau record
18:59
La Fédération Russe d'Athlétisme saisit à nouveau le TAS pour contester les sanctions de World Athletics
18:51
Le service de sécurité suédois a annoncé avoir déjoué une opération d'espionnage russe visant à discréditer la Suède, l'OTAN et l'UE.
Voir plus d’actualités