Ces modèles dits "subliminaux" peuvent être transmis par des données d'entraînement et peuvent avoir des conséquences allant de comportements apparemment inoffensifs à des comportements dangereux tels que l'incitation à l'homicide ou la promotion du trafic de stupéfiants. Les modèles semblent n'avoir aucun sens pour les humains, et les chercheurs ne savent pas exactement comment ils sont perçus par les modèles d'intelligence artificielle. L'étude a été réalisée par Anthropic en collaboration avec Truthful AI et a de sérieuses implications pour l'industrie technologique, qui s'appuie de plus en plus sur des données "synthétiques" pour l'entraînement à l'IA.
Dernières actualités
15:23
Un român din Marea Britanie a înjunghiat mortal un coleg de apartament, în urma unei dispute legate de bani
15:23
Isack Hadjar, colegul lui Verstappen de la Red Bull, va rata Marele Premiu al Olandei din cauza unei accidentări
15:16
Trois hommes de Târgu Jiu ont été impliqués dans une altercation violente, où une vitre a été brisée et un jeune homme a été attaqué avec une machette.
15:09
Noua lege a salarizării a fost trimisă la Bruxelles pentru negociere cu oficialii Comisiei Europene. Dragoș Pîslaru va prezenta concluziile partidelor la Cotroceni
15:06
Harvard va plăti despăgubiri de 53 de milioane de dolari, după ce fostul șef al morgii facultății de medicină a fost prins traficând ilegal părți din cadavrele donate
Voir plus d’actualités