In Breve (TL;DR)
- OpenAI introdurrà nell’UE il watermark textGrain nei testi generati da ChatGPT e Codex, inserendo una firma statistica nel modo in cui il modello sceglie le parole senza mostrare etichette.
- Il sistema non è infallibile: funziona meglio sui testi lunghi e poco modificati, mentre riscritture, sintesi o sostituzioni di parole possono ridurre molto la capacità di rilevare l’origine AI.
Nelle prossime settimane OpenAI inizierà a inserire un watermark invisibile all’interno dei testi generati da ChatGPT e Codex nei paesi dell'Unione Europea. La "filigrana" verrà applicata a tutti i contenuti indipendentemente dal piano di abbonamento utilizzato.
Questa tecnologia, chiamata textGrain, nasce per rispondere ai requisiti di trasparenza previsti dal Regolamento europeo sull'intelligenza artificiale (AI Act).
All'atto pratico, per l'utente non cambierà nulla e nel testo non comparirà alcuna etichetta o bollino digitale; il watermark in questione sarà, infatti, codificato direttamente dentro il processo statistico attraverso cui il modello seleziona e organizza le parole durante la stesura.
Come fa ChatGPT a inserire un watermark senza modificare il testo
Il funzionamento di textGrain si basa sull'architettura stessa con cui i modelli di linguaggio generano i contenuti e agisce sulla struttura probabilistica del testo.
Durante la generazione di una risposta, l'intelligenza artificiale seleziona la parola successiva tra varie opzioni plausibili con textGrain che altera leggermente la distribuzione di queste probabilità secondo una chiave crittografica segreta, imprimendo all’interno del testo uno schema statistico ricorrente.
Per chi legge, copia o incolla il testo, il contenuto risulterà del tutto naturale e privo di alterazioni percepibili. A differenza di altri metodi più “rudimentali”, infatti, questo nuovo sistema non inserisce caratteri Unicode invisibili, formattazioni nascoste o combinazioni di punteggiatura anomale ma la "firma" starà solamente nella micro-frequenza con cui il modello predilige determinati vocaboli rispetto ad altri.
Basta riscrivere un testo per eliminare il watermark di ChatGPT
Importante sottolineare che, nonostante la precisione di questo sistema, l'efficacia del tracciamento tramite textGrain può incontrare delle barriere fisiche e linguistiche che ne delimitano il perimetro d'azione.
La capacità di rilevare il watermark è direttamente proporzionale alla lunghezza del contenuto. Nel caso di testi molto articolati e con grandi libertà stilistiche la cosiddetta chiave statistica può essere inserita senza grossi problemi. Al contrario, messaggi brevi, formule matematiche o testi vincolati sul piano terminologico lasciano poco spazio d'azione all'algoritmo.
Oltre a questo, la modifica manuale da parte dell’utente o la sintesi del testo ne riduce drasticamente la tracciabilità.
Stando ai primi test condotti, pare che alterando anche solo il 25% delle parole all'interno di un contenuto di circa 400 token, la percentuale di successo nel rilevamento del testo AI da parte di appositi strumenti sia crollata drasticamente.
A fronte di questo, è la stessa OpenAI a precisare che un check positivo da parte dei sistemi di analisi costituisce solo un indizio di probabile contenuto generato dall’AI e non una prova certa, così come non viene garantita nemmeno la correttezza delle informazioni riprodotte.
Per saperne di più: Come funziona ChatGPT e a cosa serve
Domande frequenti (FAQ)
-
Come fa ChatGPT a inserire un watermark senza modificare il testo?Il funzionamento di textGrain si basa sull'architettura stessa con cui i modelli di linguaggio generano i contenuti e agisce sulla struttura probabilistica del testo.
-
Quali sono le limitazioni del tracciamento tramite textGrain?Testi brevi, formule matematiche o testi vincolati sul piano terminologico limitano l'efficacia del watermark, inoltre la modifica manuale o la sintesi del testo riducono la tracciabilità.
-
Basta riscrivere un testo per eliminare il watermark di ChatGPT?La capacità di rilevare il watermark è direttamente proporzionale alla lunghezza del contenuto. Quindi sì, la modifica manuale o la sintesi del testo ne riduce drasticamente la tracciabilità.



