Cette recherche, menée par des équipes de l'université de Washington, de Stanford et de l'université de Copenhague, met en lumière une méthode permettant de détecter si les modèles d'IA ont "mémorisé" des parties de leurs données d'apprentissage, ce qui pourrait constituer une violation du droit d'auteur. L'étude porte sur l'identification de mots uniques et inhabituels dans les textes littéraires, connus sous le nom de mots "grande surprise". Les résultats ont montré que GPT-4, l'un des modèles de l'OpenAI, semblait avoir mémorisé des parties de livres de fiction protégés par le droit d'auteur, en particulier à partir d'un ensemble de données appelé BookMIA.
Dernières actualités
22:57
Traian Băsescu affirme que l’AUR « a épuisé son potentiel de croissance » et devra expliquer « l’argent qu’il a donné aux chaînes de télévision »
22:50
Paramount Skydance et Warner Bros Discovery formeront Skydance après la finalisation d’une transaction de 110 milliards de dollars
22:36
Sixième jour de protestations devant l’Arrestation centrale : les partisans de Călin Georgescu demandent sa libération
22:14
Traian Băsescu, concernant la crise gouvernementale : « Ils n’ont plus d’autre solution qu’un Premier ministre indépendant »
21:56
Le Parti vert britannique a voté pour qualifier le sionisme de racisme / Israël accuse le parti de légitimer le terrorisme
Voir plus d’actualités