
ChatGPT e Codex aggiungeranno, nelle prossime settimane, ai testi destinati agli utenti dell'Unione europea una firma invisibile. Si chiama textGrain ed è il watermark invisibile con cui OpenAI prova a rendere riconoscibili i contenuti scritti dalla sua intelligenza artificiale.
La mossa risponde agli obblighi dell'AI Act europeo sulla trasparenza dei contenuti sintetici. Non cambia nulla nell'aspetto del testo che leggi, ma lascia una traccia statistica che un sistema dedicato può provare a individuare.
Il rilascio riguarda ChatGPT e Codex nell'Unione europea, mentre chi usa i modelli OpenAI tramite le API può attivarlo volontariamente anche fuori dall'Europa. Dietro la tecnologia ci sono mesi di test su accuratezza, robustezza e limiti del sistema.
Indice
ChatGPT scrive con una firma invisibile in Europa
OpenAI introdurrà gradualmente textGrain nelle prossime settimane nei testi prodotti da ChatGPT e Codex nell'Unione europea. La marcatura toccherà i contenuti compatibili generati dagli utenti, a prescindere dal piano di abbonamento usato.
Chi utilizza i modelli OpenAI tramite le API ha già la possibilità di attivare il watermark su alcuni modelli, anche fuori dall'Europa. La funzione però resta disattivata di default: deve essere lo sviluppatore a sceglierla.
Per gli utenti europei, invece, l'attivazione non richiederà alcuna azione da parte tua: scatterà automaticamente nelle prossime settimane. È la stessa logica di provenienza già usata da OpenAI per immagini e audio, applicata per la prima volta al testo.
Come funziona il segnale nascosto nelle parole
textGrain non aggiunge simboli, caratteri nascosti o marchi visibili al testo: il contenuto che leggi resta identico a prima. A cambiare è il modo in cui il modello sceglie, parola dopo parola, quale termine usare.
Ogni volta che ChatGPT deve proseguire una frase, ha davanti più alternative possibili. Il sistema ne favorisce leggermente alcune secondo uno schema legato a una chiave segreta, e su un testo abbastanza lungo queste scelte formano una sequenza statistica riconoscibile.
Il detector di OpenAI usa proprio il testo e quella chiave per cercare una dipendenza tra la casualità codificata e le parole effettivamente generate. OpenAI sostiene che l'operazione non comporti un calo misurabile della qualità delle risposte.
Quanto è affidabile il rilevamento del watermark
Con un tasso di falsi positivi fissato all'1%, il rilevatore riconosce il watermark in circa l'80% dei testi di psicologia lunghi 200 token, una soglia che sale al 95% quando il testo arriva a 400 token.
Nei testi di matematica l'affidabilità scende, perché formule e passaggi logici lasciano al modello meno alternative linguistiche tra cui scegliere. Meno libertà lessicale significa meno spazio per nascondere il segnale.
Il punto debole arriva con la riscrittura: sostituendo con sinonimi il 10% delle parole di un testo inglese da 400 token, il rilevamento è sceso da circa il 92% al 66%, e con un quarto delle parole cambiate è arrivato al 17%.
Al momento il detector resta riservato: OpenAI permetterà di usarlo soltanto a ricercatori approvati e organizzazioni esperte, sulla base di candidature esaminate una per una.
Un indizio di provenienza, non una prova
Un risultato positivo del detector indica soltanto che un sistema OpenAI potrebbe aver generato o elaborato parte del testo. Non dice chi lo ha scritto, non risale all'account usato e non rivela il prompt digitato.
textGrain non stabilisce quanta parte del lavoro sia umana, né si pronuncia su proprietà, legalità o correttezza del contenuto. Anche l'assenza del watermark non prova che un testo sia stato scritto da una persona.
Il riferimento normativo resta l'articolo 50 dell'AI Act, applicabile dal 2 agosto 2026: chiede ai fornitori di sistemi generativi di marcare i contenuti sintetici in un formato leggibile dalle macchine, riconoscibile come artificiale, nei limiti della fattibilità tecnica e dei costi di implementazione.