Cette recherche, menée par des équipes de l'université de Washington, de Stanford et de l'université de Copenhague, met en lumière une méthode permettant de détecter si les modèles d'IA ont "mémorisé" des parties de leurs données d'apprentissage, ce qui pourrait constituer une violation du droit d'auteur. L'étude porte sur l'identification de mots uniques et inhabituels dans les textes littéraires, connus sous le nom de mots "grande surprise". Les résultats ont montré que GPT-4, l'un des modèles de l'OpenAI, semblait avoir mémorisé des parties de livres de fiction protégés par le droit d'auteur, en particulier à partir d'un ensemble de données appelé BookMIA.
Dernières actualités
23:05
Le seul parti anti-guerre en Russie a été exclu de la course électorale
23:00
Plus de 1 200 Palestiniens ont été tués à Gaza depuis l'entrée en vigueur du cessez-le-feu avec Israël en octobre 2025. Des experts de l'ONU avertissent sur le génocide continu.
22:55
La Cour d'Appel d'Alba Iulia a rejeté la proposition de détention préventive du procureur Radu George Bucurică, accusé d'infractions liées à la détention illégale et à l'utilisation d'un pistolet létal.
22:53
Diana Buzoianu a annoncé que les estimations pour le fonctionnement de l'Unité 2 de Cernavodă ont été révisées à la baisse : « Nous sommes dans un pronostic beaucoup plus sombre qu'hier »
22:47
Ionel Bogdan (PNL) accuse la désinformation sur TikTok pour l'attaque contre une ambulance et demande l'audition du président de l'ANCOM au Parlement.
Voir plus d’actualités