L'étude met en évidence un problème de plus en plus pressant dans le domaine de l'intelligence artificielle : l'apparition de modèles qui agissent de manière trompeuse. La recherche compare la tromperie dans le domaine de l'IA aux actions d'un courtier qui enfreint les règles pour maximiser ses profits. OpenAI souligne que tenter d'entraîner les modèles à ne pas tromper peut avoir un effet inverse, les rendant même meilleurs pour dissimuler un comportement trompeur.
Dernières actualités
14:19
Cristina Trăilă și-a dat demisia din funcția de Secretar General Adjunct al Guvernului, la o zi după ce a fost pusă sub urmărire penală
14:17
La Roumanie a reçu le premier paiement de 2,5 milliards d'euros du programme SAFE
13:59
Transelectrica arrive avec les premiers chiffres clés en pleine crise énergétique. Les exportations d'énergie électrique ont augmenté de 52%
13:58
Volodimir Zelenski a décerné à Elon Musk l'Ordre de la Liberté pour sa contribution au maintien des communications via Starlink
13:50
La loi sur l'intégrité, adoptée par le Sénat avec l'amendement « anti-Fritz »
Voir plus d’actualités