OpenAI prevede filigrane predefinite nei testi di ChatGPT e Codex nell’UE

OpenAI attiverà di default textGrain in ChatGPT e Codex nell’UE, presentata come risposta all’AI Act, con rilevazione sensibile alle modifiche.

OpenAI prevede filigrane predefinite nei testi di ChatGPT e Codex nell’UE
AI

Immagine illustrativa generata con AI

OpenAI si prepara ad aggiungere schemi rilevabili ai testi generati con le app ChatGPT e Codex nell’Unione europea, attivando per impostazione predefinita il sistema di filigrana per gli utenti dell’UE.

La modifica è stata segnalata il 6 ottobre 2026. OpenAI afferma che la distribuzione inizierà «nelle prossime settimane», ma non ha indicato una data precisa.

L’azienda chiama la tecnica proprietaria textGrain. Invece di aggiungere etichette visibili o metadati, il sistema modifica gli schemi di scelta delle parole in modo che un rilevatore specializzato possa riconoscerli.

OpenAI presenta l’iniziativa come parte della propria risposta all’AI Act dell’UE. Tuttavia, secondo quanto riportato, sia la motivazione legata alla conformità normativa sia i dati sulle prestazioni del sistema provengono dall’azienda. Le informazioni disponibili non includono test indipendenti di textGrain.

La distribuzione nell’UE sarà diversa da quella nelle altre aree geografiche

La filigrana verrà attivata automaticamente per i testi generati con le app ChatGPT e Codex nell’Unione europea. Secondo quanto riportato, anche gli utenti delle altre aree geografiche potranno usare la funzione, che però sarà disattivata per impostazione predefinita.

Il resoconto descrive in via preliminare una configurazione simile per l’API di OpenAI: textGrain sarebbe disponibile come opzione, ma resterebbe disattivato finché non viene abilitato. Questo dettaglio sull’API è meno certo rispetto all’attivazione predefinita annunciata per le app nell’UE.

La distinzione geografica ha conseguenze operative dirette. I testi prodotti dalla stessa famiglia di servizi OpenAI potrebbero contenere o meno la filigrana a seconda dell’area geografica dell’utente, dell’applicazione e della configurazione. Di conseguenza, il fatto che un rilevatore non trovi textGrain non dimostrerebbe, da solo, che un testo sia stato scritto senza un modello OpenAI.

OpenAI collega l’impostazione predefinita nell’UE alle norme dell’AI Act che, secondo quanto riportato, richiedono che i contenuti generati dall’IA siano contrassegnati in modo rilevabile da un altro strumento. L’articolo afferma che la legge è entrata in vigore in agosto, ma non specifica l’anno. Non è quindi possibile dedurlo.

La scelta è diversa da quella attribuita ad Anthropic. Secondo la stessa fonte, Anthropic ha introdotto la filigrana testuale in agosto, attivandola a livello globale. Anche in questo caso l’anno non è specificato. OpenAI prevede invece un’attivazione automatica legata all’area geografica, con la configurazione predefinita attiva nell’UE.

textGrain modifica gli schemi di scelta delle parole

OpenAI descrive textGrain come una filigrana statistica incorporata attraverso la scelta delle parole. Gli schemi non dovrebbero essere riconoscibili da chi legge il testo e, secondo l’azienda, non ne riducono in modo significativo la qualità generale.

Per rilevarli servono uno strumento dedicato e una chiave in grado di identificarli. È un approccio diverso da una dichiarazione visibile, come un’etichetta sopra il testo generato. Si distingue anche dai normali metadati, che possono andare persi quando il testo viene copiato in un altro documento o servizio di messaggistica.

Le informazioni disponibili non descrivono l’algoritmo, il sistema di gestione delle chiavi né altri dettagli tecnici. Affermano che OpenAI ha pubblicato un documento tecnico, ma il materiale fornito non include il relativo link.

Inizialmente l’accesso al rilevatore sarà limitato. OpenAI prevede di metterlo a disposizione di un gruppo ristretto di ricercatori e organizzazioni, consentendo ad altri soggetti di richiedere l’autorizzazione. Di conseguenza, non è detto che i comuni utenti possano inviare testi a piacere per verificarli autonomamente.

Questo modello concentra le verifiche nelle mani delle organizzazioni autorizzate. A seconda dei destinatari, tra i potenziali utilizzatori potrebbero esserci ricercatori che studiano i contenuti sintetici o organizzazioni che valutano il materiale inviato attraverso i propri sistemi. OpenAI non ha dimostrato questi usi specifici nelle informazioni fornite: si tratta quindi di possibili applicazioni, non di impieghi già confermati.

L’accuratezza dichiarata cala quando il testo viene modificato

Nei test migliori riportati da OpenAI, textGrain ha raggiunto un tasso di rilevamento corretto del 92%. Si tratta di un risultato riferito dall’azienda, non di un dato sulle prestazioni verificato in modo indipendente sulla base delle informazioni disponibili.

I dati riportati mostrano inoltre una notevole sensibilità alle modifiche:

  • Modificare il 10% di un testo ha ridotto il tasso di rilevamento corretto di quasi il 30%.
  • Modificare il 20% poteva ridurre il tasso di rilevamento corretto di quasi il 75%.
  • In generale, il rilevamento era meno efficace sui testi brevi.
  • I testi tradotti erano più difficili da identificare rispetto a quelli più lunghi e non modificati.

La fonte non chiarisce se le riduzioni di quasi il 30% e quasi il 75% siano relative o espresse in punti percentuali. Non è quindi possibile ricavarne con certezza i tassi di rilevamento finali.

Per esempio, non sarebbe giustificato sottrarre direttamente quei valori dal risultato migliore del 92%. Sarebbe altrettanto infondato supporre che ogni tipo di riscrittura produca lo stesso effetto. I dati descrivono test riferiti da OpenAI, condotti in condizioni che il resoconto disponibile non specifica.

Questi limiti sono rilevanti perché i testi generati vengono spesso modificati prima della pubblicazione. Una persona può accorciare una risposta, riorganizzarla, tradurla o combinarla con contenuti scritti autonomamente. Queste normali trasformazioni potrebbero indebolire il rilevamento anche senza un tentativo intenzionale di rimuovere la filigrana.

D’altra parte, un risultato positivo indicherebbe che lo strumento ha individuato lo schema atteso. Le informazioni riportate non stabiliscono come interpretare un simile risultato in ambito accademico, lavorativo o legale.

Le filigrane sono segnali, non prove durature della provenienza

Ars Technica ritiene che i sistemi di filigrana esistenti, tra cui SynthID di Google e il progetto C2PA, siano relativamente facili da aggirare per chi ha conoscenze di base. La testata prevede che textGrain possa incontrare difficoltà simili.

Questa è la valutazione di Ars Technica. Il materiale fornito non contiene dimostrazioni indipendenti che textGrain sia stato aggirato, né documenta metodi attualmente utilizzati per eludere il sistema di OpenAI.

I risultati dei test sulle modifiche riferiti dalla stessa OpenAI mostrano comunque i limiti pratici del rilevamento delle filigrane. Uno schema statistico nascosto deve resistere a riscrittura, traduzione e riduzione del testo, restando al contempo impercettibile per chi legge. Migliorarne la resistenza in un ambito potrebbe incidere sulla qualità o sulla prevedibilità del testo, ma le informazioni disponibili non documentano questi compromessi per textGrain.

È quindi più corretto considerare la filigrana un segnale di attribuzione, non una prova conclusiva. Il rilevamento potrebbe aiutare un’organizzazione autorizzata a identificare alcuni testi generati da OpenAI e non modificati, o modificati solo in misura limitata. L’assenza dello schema può avere diverse spiegazioni: modifiche, traduzione, lunghezza ridotta, uso al di fuori dell’UE oppure generazione tramite un canale in cui la filigrana non era attiva.

Cosa cambia per utenti e organizzazioni

Gli utenti dell’UE che utilizzano le app ChatGPT e Codex dovrebbero aspettarsi che la filigrana si attivi automaticamente quando la distribuzione li raggiungerà. OpenAI non ha descritto procedure di correzione, soluzioni alternative o misure di mitigazione per gli utenti: si tratta di una modifica al prodotto e alla conformità normativa, non di una vulnerabilità o di una violazione.

Gli utenti al di fuori dell’UE non dovrebbero dare per scontato che i loro testi siano contrassegnati solo perché textGrain è disponibile. Secondo quanto riportato, in queste aree geografiche la funzione resta disattivata per impostazione predefinita. Anche i clienti dell’API dovranno verificare la configurazione effettiva del servizio, senza presumere che i testi generati tramite API contengano la filigrana.

Le organizzazioni che intendono ricorrere al rilevamento dovrebbero considerare i limiti dichiarati prima di definire le proprie procedure. Nei test riportati, testi brevi, traduzioni e contenuti modificati risultano associati a un rilevamento meno efficace. L’accesso allo strumento dipenderà inoltre dalla selezione da parte di OpenAI o dall’approvazione della richiesta.

L’annuncio non è associato a incidenti di sicurezza, CVE, conteggi di persone coinvolte o classificazioni convenzionali della gravità. La modifica immediata è più circoscritta: OpenAI intende rendere standard gli schemi testuali rilevabili da una macchina nelle proprie app destinate ai consumatori nell’UE, lasciando facoltativa la filigrana altrove.

Leggi anche

Fonti

Questo articolo è una rielaborazione originale basata sulle fonti seguenti.

Torna alla home

Ultime notizie di cybersecurity

Tutte le notizie di cybersecurity →