Cette recherche, menée par des équipes de l'université de Washington, de Stanford et de l'université de Copenhague, met en lumière une méthode permettant de détecter si les modèles d'IA ont "mémorisé" des parties de leurs données d'apprentissage, ce qui pourrait constituer une violation du droit d'auteur. L'étude porte sur l'identification de mots uniques et inhabituels dans les textes littéraires, connus sous le nom de mots "grande surprise". Les résultats ont montré que GPT-4, l'un des modèles de l'OpenAI, semblait avoir mémorisé des parties de livres de fiction protégés par le droit d'auteur, en particulier à partir d'un ensemble de données appelé BookMIA.
Dernières actualités
22:57
Basket féminin : la Roumanie a battu la Lituanie et a été promue en Division A du Championnat d'Europe U18
22:30
Le ministre des Finances, Alexandru Nazare, annonce après les évaluations de Fitch et Moody's : "les risques économiques restent élevés"
21:45
Une nouvelle tentative de migration en masse à Ceuta et Melilla a été préparée sur les réseaux sociaux pour le 15 août
21:16
Une voiture est restée bloquée entre les barrières au passage à niveau de la route Petricani, tandis qu'un train s'approchait.
20:36
La Turquie impose des restrictions sur les navires commerciaux se dirigeant vers la mer Noire en raison de l'intensification des attaques russes et ukrainiennes.
Voir plus d’actualités