Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
19:50
Le gouvernement allemand a annoncé une réforme des services de renseignement, élargissant leurs compétences opérationnelles pour faire face aux menaces extérieures.
19:50
Des sources pakistanaises affirment que le cessez-le-feu convenu entre les États-Unis et l'Iran pourrait être prolongé de 60 ou 90 jours.
19:45
Le président de l'ANSVSA, Alexandru Bociu, souligne l'importance de la traçabilité rigoureuse des animaux pour la réouverture des marchés internationaux et le regain de confiance de la Commission européenne.
19:40
Le président turc Recep Tayyip Erdogan a annoncé son intention d'étendre l'accord de défense signé avec l'Arabie Saoudite et le Pakistan.
19:35
Miele a nommé Bogdan Bayer au poste de Country Manager pour la Roumanie, la Bulgarie et la Serbie, avec pour objectif le développement stratégique et l'amélioration de l'expérience client.
Voir plus d’actualités