Cette recherche, menée par des équipes de l'université de Washington, de Stanford et de l'université de Copenhague, met en lumière une méthode permettant de détecter si les modèles d'IA ont "mémorisé" des parties de leurs données d'apprentissage, ce qui pourrait constituer une violation du droit d'auteur. L'étude porte sur l'identification de mots uniques et inhabituels dans les textes littéraires, connus sous le nom de mots "grande surprise". Les résultats ont montré que GPT-4, l'un des modèles de l'OpenAI, semblait avoir mémorisé des parties de livres de fiction protégés par le droit d'auteur, en particulier à partir d'un ensemble de données appelé BookMIA.
Dernières actualités
13:43
La Russie et l'Ukraine ont effectué un nouvel échange de prisonniers, chaque partie remettant 103 militaires.
13:26
Amendes de plus de 130 000 lei, données par l'ANSVSA après des contrôles dans les établissements qui vendent des aliments dans les stations-service.
13:23
Conseil de la Concurrence : Inspections inopinées en cas de possible entente anticoncurrentielle dans l'acquisition d'équipements médicaux
13:15
Diana Buzoianu accuse Romsilva de violation des recommandations de la Cour des Comptes : « Romsilva a récemment inclus dans le Contrat Collectif de Travail la prime collective »
12:56
Sondage : Élections en Suisse / Près de deux tiers des Suisses s'opposent aux propositions de redéfinition de la neutralité
Voir plus d’actualités