In questo articolo Indice dei contenuti 2 sezioni
OpenAI ha deciso di allinearsi alle regole sulla trasparenza previste dall’AI Act, entrate in vigore lo scorso 2 agosto, e lo fa con textGrain, una filigrana invisibile pensata per rendere riconoscibili i testi prodotti dall’intelligenza artificiale. Una mossa che segue quella già compiuta da Anthropic e che riguarderà da vicino chi usa ChatGPT per scrivere email, relazioni o compiti.
L’aggiornamento arriverà nelle prossime settimane e verrà applicato sia ai contenuti generati da ChatGPT sia a quelli di Codex. Il raggio d’azione per ora è quello dell’Unione Europea. Fuori dai confini comunitari textGrain è già disponibile tramite API, ma solo come opzione da attivare.
Come funziona il watermark di OpenAI
Non ci sarà nessun simbolo strano nascosto tra le righe, nessun carattere invisibile da scovare con un editor. Il watermark si basa invece su precise scelte lessicali compiute dal modello mentre genera il testo. In pratica le parole selezionate seguono uno schema statistico che uno strumento dedicato è in grado di riconoscere. Più il testo è lungo, più il disegno emerge con chiarezza.
Detto questo, la stessa OpenAI mette le mani avanti precisando che non si tratta di una macchina della verità. Nei test interni il tasso di falsi positivi si è fermato all’1%, mentre la filigrana è stata individuata nell’80% dei testi da 200 token e nel 95% di quelli da 400 token appartenenti ad alcune categorie, come quelle di matrice psicologica. Con i testi brevi la precisione cala sensibilmente e il terreno più ostico resta quello dei contenuti matematici.
C’è poi la questione delle modifiche. Basta sostituire il 10% delle parole con dei sinonimi per far scendere la capacità di rilevamento dal 92% al 66%. E se le parole cambiate arrivano al 25% il dato crolla fino al 17%. Un intervento di riscrittura nemmeno troppo profondo è quindi sufficiente a mettere in difficoltà il sistema.
Cosa può rivelare textGrain e cosa no
Il nuovo strumento può suggerire che un testo, o una parte di esso, sia stato redatto da un sistema di OpenAI. Non è però in grado di risalire all’identità dell’utente che ha avviato la generazione, né di mostrare il prompt o la conversazione da cui il contenuto ha avuto origine. Allo stesso modo sapere che uno scritto porta la firma dell’intelligenza artificiale non basta a stabilire quanto lavoro sia stato svolto da una persona e quanto dalla macchina.
Anche l’uso del rilevatore avrà dei paletti. Proprio per il rischio di falsi positivi e falsi negativi, l’accesso a textGrain sarà concesso in una prima fase soltanto a ricercatori e organizzazioni approvate a discrezione dell’azienda. Ulteriori dettagli arriveranno più avanti, con l’obiettivo dichiarato di rendere la tecnologia open source.
Per immagini e audio il discorso cambia. OpenAI mette già a disposizione uno strumento pubblico in cui caricare alcuni file per cercare i segnali di provenienza legati ai propri sistemi. Sul fronte delle immagini combina i Content Credentials, basati sullo standard C2PA, con SynthID, la filigrana invisibile sviluppata da Google DeepMind. Lo stesso SynthID viene impiegato anche per alcuni contenuti audio.
Fonte: TecnoAndroid








