Riassunto:
OpenAI sta gradualmente aggiungendo filigrane invisibili ai testi generati da ChatGPT e Codex nell'Unione Europea per soddisfare i requisiti della legge sull'intelligenza artificiale dell'UE per la leggibilità dei contenuti generati dall'intelligenza artificiale. OpenAI ha affermato che questa tecnologia di filigrana del testo chiamata textGrain non aggiunge caratteri nascosti, spazi invisibili o punteggiatura speciale all'articolo. Al contrario, adatta il metodo di selezione delle parole quando il modello genera il testo, formando una caratteristica statistica nell’intero testo che non può essere rilevata direttamente dall’occhio umano ma può essere riconosciuta dalla macchina.

Secondo le informazioni rilasciate da OpenAI, i pertinenti requisiti di trasparenza della legge sull'intelligenza artificiale dell'Unione europea entreranno in vigore il 2 agosto 2026. I fornitori di servizi di intelligenza artificiale generativa sono tenuti a disporre di contenuti generati dall'intelligenza artificiale con marchi riconoscibili dalle macchine. OpenAI prevede quindi di implementare gradualmente filigrane di testo per gli utenti ChatGPT e Codex idonei nell'UE nelle prossime settimane, e questa distribuzione coprirà tutti i pacchetti ChatGPT, non solo gli utenti paganti.
Questo tipo di filigrana è diverso dal "testo nascosto" nel senso tradizionale. Quando gli utenti copiano il contenuto generato da ChatGPT, un carattere nascosto non verrà copiato contemporaneamente e nel testo non verrà trovato nessun simbolo speciale. Ciò che textGrain cambia effettivamente è la probabilità di selezione casuale del modello di fronte a più parole possibili. I cambiamenti in una singola parola possono essere completamente non rilevabili, ma quando un gran numero di parole vengono combinate, si può formare un modello statistico che il sistema di rilevamento può riconoscere.
OpenAI ha affermato che il vantaggio di questo design è che non modifica in modo significativo il normale output del testo. I test dell'azienda hanno rilevato che la differenza nelle prestazioni del modello tra l'aggiunta e la mancata aggiunta di filigrane rientrava nel normale intervallo di fluttuazione del test e anche l'impatto sulla velocità di generazione del testo era molto ridotto. Durante i precedenti test interni di ChatGPT, OpenAI non ha riscontrato che la funzione filigrana portasse ad un aumento delle recensioni negative degli utenti.
Tuttavia, OpenAI ha anche ammesso che la filigrana del testo non è un metodo affidabile al 100% per identificare i contenuti AI. Esistono due possibili errori nel rilevamento della filigrana. Il primo è che il testo senza filigrana viene erroneamente considerato come dotato di filigrana, mentre l'altro è che il testo in realtà ha una filigrana, ma il sistema di rilevamento non la riconosce.
Anche la lunghezza del testo è un fattore importante che influisce sui risultati del rilevamento. Un testo più breve ha meno spazio affinché il modello possa regolare la selezione delle parole, rendendo più difficile la formazione di un segnale statistico stabile. Le regole pubblicate da OpenAI mostrano inoltre che, in conformità con le specifiche di trasparenza dell'UE sull'IA, non è necessario aggiungere filigrane di testo per output inferiori a 200 token, circa 150 parole inglesi e frammenti di codice.
Esistono differenze anche nei risultati del rilevamento tra le diverse lingue. OpenAI ha testato tutte le 24 lingue ufficiali dell'Unione Europea. Pur mantenendo un tasso di falsi positivi dell'1%, il tasso di rilevamento dello spagnolo ha raggiunto un massimo del 69%, mentre il tasso di rilevamento del rumeno è stato solo del 42,2%. Per le lingue con effetti di rilevamento deboli, OpenAI può aumentare la forza della filigrana per migliorare le capacità di rilevamento.
Ciò significa che textGrain non può essere intesa come una tecnologia che può dimostrare al 100% di essere stata generata da ChatGPT quando vedi la filigrana. OpenAI chiarisce che anche se il testo originale non è stato modificato, non vi è alcuna garanzia che il sistema di rilevamento riesca a rilevare la filigrana, soprattutto quando il testo è breve o il range di parole selezionabili è ridotto.
Allo stesso tempo, esistono evidenti differenze tra le filigrane di testo e i rilevatori di testo AI attualmente sul mercato. Gli strumenti di rilevamento dell’intelligenza artificiale di terze parti come Pangram utilizzano principalmente classificatori per determinare se è probabile che una porzione di testo venga generata dall’intelligenza artificiale analizzando la scelta delle parole, la struttura della frase e altre caratteristiche del linguaggio. Questo metodo analizza il testo dopo che è stato generato, mentre textGrain lascia direttamente un segnale statistico leggibile dalla macchina durante il processo di generazione del testo.
OpenAI ritiene che questo approccio sia più in linea con i requisiti della legge UE sull'intelligenza artificiale per i segnali identificabili "incorporati".
OpenAI non ha adottato direttamente SynthID di Google DeepMind o altre soluzioni esistenti di filigrana di testo, ma ha sviluppato textGrain in proprio. La società ha affermato che la sua tecnologia sviluppata internamente le consente di regolare in modo più flessibile l’equilibrio tra la rilevabilità delle filigrane e la diversità degli output del modello. Nei test interni, textGrain ha riconosciuto il testo con filigrana a una velocità pari o superiore rispetto ad altre soluzioni testate dall'azienda, incluso SynthID per il testo.
OpenAI prevede inoltre di rendere open source la tecnologia textGrain, sperando che altri istituti di ricerca e aziende possano utilizzare questa tecnologia per approfondire la ricerca e migliorare il riconoscimento della fonte di testo AI. Tuttavia, OpenAI non aprirà immediatamente al pubblico il rilevatore di filigrane di testo, ma fornirà prima i canali di applicazione a ricercatori e istituzioni professionali approvati.
Questi ricercatori e istituzioni autorizzati possono utilizzare gli strumenti di rilevamento di OpenAI per determinare se una porzione di testo contiene una filigrana generata da OpenAI, ma i risultati del rilevamento non riveleranno l'identità dell'utente, le parole richieste o i record di chat corrispondenti al contenuto generato. OpenAI ritiene che, poiché la tecnologia attuale presenta ancora rischi di falsi positivi e falsi negativi, aprire direttamente gli strumenti di rilevamento a tutti potrebbe portare a un'interpretazione eccessiva dei risultati di rilevamento della filigrana.
Vale la pena notare che questa volta OpenAI non prevede di abilitare le filigrane di testo per impostazione predefinita a livello globale. La società ha dichiarato che in questa fase le filigrane di testo di ChatGPT e Codex verranno gradualmente implementate solo per la regione dell’UE. Questa distribuzione regionale consentirà a OpenAI di osservare le prestazioni in ambienti di utilizzo reali e di adattare la tecnologia in base al feedback effettivo.
Per gli sviluppatori API la situazione è diversa. OpenAI ha iniziato a consentire ai clienti API globali di attivare attivamente la funzione di filigrana di testo per alcuni modelli, ma è ancora disattivata per impostazione predefinita. Ciò significa che le aziende possono decidere se filigranare il testo generato tramite API in base ai propri requisiti di trasparenza.
OpenAI si sta inoltre coordinando con i partner dei servizi cloud, sperando che nelle prossime settimane anche i contenuti idonei generati chiamando modelli OpenAI attraverso queste piattaforme cloud ricevano segnali di origine corrispondenti.
Tuttavia, le filigrane di testo non sostituiranno altri metodi di identificazione dei contenuti AI. OpenAI sottolinea che le informazioni sulla fonte come filigrane leggibili dalla macchina e C2PA non possono sostituire dichiarazioni pubbliche come etichette AI visibili e banner di richiesta richiesti dalla legge o dalla piattaforma. Risolvono i problemi relativi alla fonte di contenuto a diversi livelli.
Per gli utenti ordinari, la cosa più degna di nota di questo cambiamento è: se ti trovi nell'UE e utilizzi ChatGPT per generare testo lungo, dal momento in cui il sistema di filigrana copre ufficialmente il tuo account, il contenuto generato potrebbe già contenere segnali di origine invisibili a occhio nudo. La copia diretta del testo originale solitamente non distrugge questo segnale, ma se il testo viene riscritto, riformulato o tradotto in modo significativo, la rilevabilità della filigrana potrebbe essere notevolmente ridotta.
OpenAI riconosce inoltre esplicitamente questa limitazione. Il segnale di textGrain esiste nella selezione delle parole del modello, piuttosto che come carattere invisibile allegato indipendentemente al file di testo. Pertanto, una riscrittura sufficiente del testo potrebbe distruggere il modello statistico originale. Questo è il motivo per cui OpenAI sottolinea che le filigrane di testo sono attualmente più adatte come segnale di giudizio sulla fonte e non possono essere considerate un "certificato di identificazione AI" assolutamente affidabile.
In generale, OpenAI ha lanciato textGrain nell'UE questa volta principalmente per adattarsi ai nuovi requisiti normativi introdotti dalla legge sull'AI. Rappresenta inoltre che l'identificazione della fonte del testo generato dall'intelligenza artificiale si sta evolvendo dai tradizionali "tag dichiarativi" a segnali riconoscibili dalla macchina. Non cambierà il testo che gli utenti vedono, né appariranno caratteri misteriosi durante la copia del testo, ma consentirà ai sistemi con permessi di rilevamento di provare a determinare se un contenuto proviene da un modello OpenAI.
Tuttavia, poiché le filigrane di testo presentano ancora problemi come differenze linguistiche, restrizioni sulla lunghezza del testo e indebolimento del segnale dopo la riscrittura, attualmente sono più adatte come prova ausiliaria nel sistema di tracciabilità dei contenuti dell'IA, piuttosto che essere utilizzate da sole per determinare se un articolo è stato "scritto dall'AI".
Commenti