OpenAI introdurrà, nelle prossime settimane, un watermark invisibile per i testi generati da ChatGPT e Codex nell’Unione europea, nell’ambito delle misure di conformità ai requisiti dell’AI Act. Il contrassegno sarà disponibile per gli utenti idonei, indipendentemente dal tipo di abbonamento.
La tecnologia, denominata textGrain, inserisce un segnale statistico nel modo in cui il modello seleziona le parole. Questo segnale può essere rilevato automaticamente e indica se un testo contiene un watermark di OpenAI, senza rivelare l’identità dell’utente, il prompt o la conversazione da cui proviene.
Secondo le valutazioni dell’azienda, il watermark è stato identificato in circa l’80% dei testi di 200 token e nel 95% di quelli di 400 token. L’efficacia diminuisce tuttavia dopo la modifica: la sostituzione del 10% delle parole con sinonimi ha ridotto il tasso di rilevamento dal 92% al 66%, mentre la sostituzione del 25% delle parole ha portato il tasso al 17%. Anche i testi brevi, restrittivi o tradotti sono più difficili da verificare.
OpenAI avverte che il sistema può produrre falsi positivi o falsi negativi. Il watermark non può stabilire quanto abbia scritto una persona, chi sia responsabile del testo, se le informazioni siano vere o se un contenuto privo di contrassegno sia stato scritto da un essere umano.
Il rilevatore non sarà disponibile pubblicamente al momento del lancio. L’accesso sarà inizialmente offerto a ricercatori e organizzazioni specializzate approvate. A livello globale, alcuni clienti API potranno scegliere di attivare la funzione.
Fonti
Ultime notizie
17:13
17:11
17:00
16:53
16:48
Vedi altre notizie