Cette recherche, menée par des équipes de l'université de Washington, de Stanford et de l'université de Copenhague, met en lumière une méthode permettant de détecter si les modèles d'IA ont "mémorisé" des parties de leurs données d'apprentissage, ce qui pourrait constituer une violation du droit d'auteur. L'étude porte sur l'identification de mots uniques et inhabituels dans les textes littéraires, connus sous le nom de mots "grande surprise". Les résultats ont montré que GPT-4, l'un des modèles de l'OpenAI, semblait avoir mémorisé des parties de livres de fiction protégés par le droit d'auteur, en particulier à partir d'un ensemble de données appelé BookMIA.
Dernières actualités
09:41
Un tremblement de terre de magnitude 5,5 a secoué mercredi El Salvador, le Honduras et le Nicaragua, sans provoquer de victimes ni de dommages.
09:27
Fragment possible de drone, observé au large de la mer, dans la zone de Costinești. Les autorités interviennent en ce moment sur place.
09:07
Le débit du Danube à l'entrée en Roumanie reste stable, en dessous de la moyenne pluriannuelle du mois d'août. Les hydrologues estiment une légère augmentation dans les prochaines 24 heures.
08:55
Volodimir Zelenski, interview pour CNN : « Si les États-Unis nous vendent 10 % de leurs missiles Patriot, nous détruirons tous les missiles balistiques russes »
08:50
Attaque russe sur le port d'Izmail, à proximité de la frontière avec la Roumanie. L'infrastructure portuaire a été embrasée par un incendie.
Voir plus d’actualités