OpenAI ha annunciato che inserirà il sistema textGrain, una filigrana invisibile nei testi generati da ChatGPT e Codex. Il rilascio inizierà nelle prossime settimane e riguarda tutti i piani, ma solo chi si trova nell’Unione Europea. Il motivo è normativo, perché le regole di trasparenza dell’AI Act, in vigore dal 2 agosto, chiedono ai fornitori di rendere il contenuto generato identificabile in modo leggibile dalle macchine. Chi sviluppa con le API, ovunque si trovi, può attivare la stessa funzione su modelli selezionati, ma di default resta spenta.
L’azienda spiega con chiarezza che cosa il sistema, chiamato textGrain, può dire e che cosa no, e ha pubblicato un rapporto tecnico scritto con ricercatori dell’Università della Pennsylvania e dell’Università di Yale. La notizia interessa chiunque scriva con un assistente, ovvero studenti, redattori e professionisti. A tal proposito, Anthropic ha adottato una soluzione analoga già ad agosto, ma con applicazione globale. Capire come funziona la filigrana aiuta a evitare sia timori eccessivi sia false sicurezze.
Come funziona textGrain e quanto è affidabile
La filigrana di textGrain non potendo aggiunge caratteri nascosti, spazi invisibili o punteggiatura insolita, agisce invece sulle probabilità con cui il modello sceglie la parola successiva, orientandole secondo uno schema legato a una chiave segreta. Il segnale vive quindi nelle parole stesse e sopravvive al copia e incolla, mentre il rilevatore, avendo testo e chiave, ne misura la presenza statistica. I dati diffusi da OpenAI mostrano però quanto il metodo dipenda dalle condizioni. Con un tasso di falsi positivi fissato all’1%, il rilevatore individua circa l’80% dei passaggi di 200 token e circa il 95% di quelli di 400, per temi come la psicologia. Per la matematica, dove la scelta lessicale è più rigida, i risultati sono nettamente inferiori.

Anche le modifiche pesano. Sostituire il 10% delle parole con sinonimi porta il rilevamento da circa il 92% al 66%, mentre con il 25% si scende al 17%. Traduzioni e testi brevi complicano ulteriormente il quadro. Per questo il rilevatore è accessibile soltanto a ricercatori e organizzazioni approvate, e segnala solo la presenza di una filigrana OpenAI, senza identificare persone o conversazioni. Sulla qualità, l’azienda dichiara differenze trascurabili su otto benchmark con il modello Astra, ad esempio 94,44% contro 93,94% su GPQA Diamond.
Cosa cambia per chi scrive con l’AI
L’iniziativa di OpenAI appare come un adempimento regolatorio gestito con cautela. Limitare il debutto a ChatGPT e Codex in Europa, lasciare l’opzione alle API e tenere il rilevatore fuori dalla portata del pubblico sono scelte coerenti con una tecnologia che l’azienda stessa definisce acerba.













