In questo articolo Indice dei contenuti 2 sezioni
Per gli utenti europei ChatGPT sta per cambiare in un modo che quasi nessuno noterà a occhio nudo. Nelle prossime settimane i testi prodotti dal chatbot di OpenAI e da Codex inizieranno a contenere un watermark invisibile, pensato per permettere alle piattaforme di riconoscere in automatico i contenuti generati da un modello linguistico. La spinta arriva dall’Unione Europea, che vuole rendere identificabile ciò che esce da questi sistemi proprio mentre distinguere un testo scritto da una persona da uno prodotto da una macchina diventa sempre più complicato.
Il problema del resto è noto da tempo. Esistono già strumenti capaci di stimare con buona precisione quanto un testo sia umano oppure no, eppure capire con certezza quando dietro certe frasi ci sia l’intelligenza artificiale rimane un’impresa tutt’altro che semplice. Le richieste di Bruxelles puntano quindi a spostare il riconoscimento a monte, direttamente sulle piattaforme, ed è qui che entra in gioco la novità annunciata per il chatbot più famoso del momento.
Cos’è textGrain e perché non si vede
Il sistema si chiama textGrain e funziona in modo diverso da quanto molti potrebbero immaginare. Niente simboli strani, nessuna firma nascosta in fondo al messaggio, nessun carattere invisibile infilato tra una parola e l’altra. Il marchio non viene aggiunto al testo dopo la generazione ma nasce insieme alle parole stesse, perché interviene proprio sulle scelte lessicali compiute dal modello mentre scrive.
È un approccio piuttosto elegante, se ci si pensa. Con textGrain chi legge una risposta di ChatGPT si troverà davanti a un testo del tutto normale, senza elementi fuori posto che possano tradirne l’origine e senza nulla che ne alteri la lettura. L’impronta c’è, ma rimane nascosta nella struttura stessa del linguaggio e diventa leggibile soltanto per chi possiede gli strumenti giusti per andarla a cercare.
Come funziona l’impronta statistica di ChatGPT
OpenAI ha confermato l’arrivo della funzione e ha spiegato come opera questo meccanismo, senza nascondere pregi e difetti. Il principio di base è legato al modo in cui un modello linguistico costruisce le frasi. Ogni volta che ChatGPT deve decidere come proseguire un periodo ha davanti diverse opzioni possibili, e con il nuovo sistema può preferire determinate parole rispetto ad altre seguendo uno schema statistico conosciuto dallo strumento di rilevamento.
Presa da sola, una di queste scelte non significa nulla. Un termine al posto di un sinonimo può comparire in qualsiasi testo, scritto da chiunque. Il discorso cambia quando le decisioni analizzate diventano centinaia, perché a quel punto la somma delle preferenze lascia emergere una sorta di impronta digitale del testo, un disegno coerente che si rivela solo osservando l’insieme.
È proprio questa ripetizione a rendere riconoscibile il contenuto agli occhi del sistema. Il lettore non percepisce alcuna differenza, mentre lo strumento di verifica, che conosce in anticipo lo schema utilizzato, è in grado di individuarlo esaminando le parole scelte dal modello nel corso della scrittura. Il watermark riguarderà i testi generati da ChatGPT e da Codex per gli utenti europei, e il suo debutto è previsto nelle prossime settimane.
Fonte: TecnoAndroid








