OpenAI ha pubblicato il 5 ottobre 2026 il proprio approccio alla provenienza dei testi generati dall’IA, in risposta all’EU AI Act, che chiede ai fornitori di rendere identificabili in modo leggibile da una macchina i contenuti generati. Secondo il comunicato di OpenAI, nelle prossime settimane un watermark invisibile sarà aggiunto ai testi idonei di ChatGPT e Codex nell’Unione europea. Per le API il sistema sarà attivabile su richiesta, in tutto il mondo.
Cosa cambia e dove: UE, API e rilevatore
L’azienda descrive un’introduzione a fasi, motivata dai limiti attuali di queste tecnologie. Il watermark sul testo non diventa un’impostazione predefinita globale al lancio: la scelta regionale, spiega OpenAI, serve a imparare dall’uso reale e dai riscontri.
- ChatGPT e Codex: watermark invisibile sull’output idoneo, per gli utenti di tutti i piani, solo nell’UE, nelle prossime settimane.
- API: dal 5 ottobre i clienti di tutto il mondo possono attivare il watermark per alcuni modelli. Resta disattivato per impostazione predefinita. OpenAI lavora anche con i partner cloud per renderlo disponibile sugli output dei suoi modelli accessibili dai loro servizi, nelle prossime settimane.
- Rilevatore: sono aperte le candidature per accedervi, ma l’accesso è limitato a ricercatori approvati e organizzazioni esperte.
Gli strumenti di verifica per immagini e audio, tra cui il sito openai.com/verify e la Content Provenance API, restano pubblici.

Come funziona textGrain
La tecnologia si chiama textGrain e inserisce un segnale statistico invisibile nelle parole scelte dal modello. Il rilevatore cerca quel segnale per stabilire se un brano contiene un watermark di OpenAI. Il rapporto tecnico sarà aggiornato nelle prossime settimane e l’azienda prevede di rendere la tecnologia open source.
Nelle valutazioni di OpenAI, textGrain ha eguagliato o superato gli altri approcci provati, SynthID per il testo compreso. L’azienda precisa però che buone prestazioni in condizioni ideali non garantiscono un rilevamento affidabile nell’uso quotidiano.
I limiti misurati: lunghezza, tipo di contenuto, modifiche
OpenAI indica due tipi di errore: falsi positivi (watermark segnalato dove non c’è) e falsi negativi (watermark non visto). Con un tasso di falsi positivi fissato all’1%, il rilevatore ha trovato il watermark in circa l’80% dei brani da 200 token e in circa il 95% di quelli da 400 token, per contenuti come la psicologia. Per contenuti come la matematica, dove le parole sono meno libere, i tassi sono nettamente più bassi.
Anche le modifiche pesano. Su brani da 400 token, sostituire il 10% delle parole con sinonimi ha ridotto il rilevamento da circa il 92% al 66%; sostituirne il 25% lo ha portato al 17%. I dati si riferiscono a risposte in inglese a domande del dataset ELI5. Questi limiti sono tra i motivi per cui il rilevatore non è pubblico.
Effetto sulla qualità: i benchmark di Astra
Sui benchmark usati per valutare Astra, OpenAI dice di non vedere differenze significative tra testo con e senza watermark (configurazione «max»).
| Benchmark | Senza watermark | Con watermark |
|---|---|---|
| Artificial Analysis Intelligence Index | 49,57 punti | 49,76 punti |
| AutomationBench | 34,09% | 34,86% |
| DeepSWE v1.1 | 72,80% | 71,68% |
| Terminal-Bench 4.0 | 53,90% | 56,06% |
| Terminal-Bench Science 0.1 | 56,90% | 60,00% |
| BrowseComp | 87,92% | 87,35% |
| HealthBench Professional | 64,27% | 64,60% |
| GPQA Diamond | 94,44% | 93,94% |
Cosa un watermark sul testo non dimostra
OpenAI mette in chiaro cosa non si può concludere da un risultato del rilevatore:
- non misura il contributo umano: indica che un sistema OpenAI ha generato o elaborato parte del brano, non quanto lavoro umano ci sia dentro;
- non stabilisce proprietà o responsabilità, né la liceità dell’uso o l’obbligo di dichiararlo;
- non identifica l’utente e non lega il testo a persone, account, prompt o conversazioni;
- non verifica l’accuratezza di ciò che è scritto;
- l’assenza di watermark non prova che l’autore sia umano: il testo può essere troppo breve, modificato o tradotto, venire da un modello non supportato, essere precedente al watermark o provenire da strumenti di un’altra azienda.
L’accesso al rilevatore
Secondo OpenAI, in linea con il Code of Practice, l’accesso al rilevatore di testo sarà concesso inizialmente caso per caso, per sostenere la valutazione e il miglioramento della tecnologia di provenienza del testo.