IA

ChatGPT, arriva in Ue la filigrana sui testi che OpenAI aveva tenuto nel cassetto

Adrian Kessler
Aggiungici su Google

Per molto tempo OpenAI ha spiegato pubblicamente perché non avrebbe applicato una filigrana ai testi di ChatGPT. Ora, invece, lo farà. Non è stata la tecnologia a farle cambiare idea: è una legge, con una scadenza e una multa in caso di inadempienza.

L’azienda afferma che i testi generati da ChatGPT e Codex per gli utenti dell’Unione europea conterranno una firma statistica invisibile, introdotta gradualmente nelle prossime settimane e su tutti i piani. Nel resto del mondo lo stesso contrassegno è disponibile soltanto come opzione nell’API per sviluppatori, disattivata per impostazione predefinita. Il confine tracciato da OpenAI coincide con quello della giurisdizione che può sanzionarla.

Come funziona la filigrana di ChatGPT

Il metodo, chiamato textGrain, non imprime nulla di visibile sul testo prodotto. Quando più parole successive potrebbero adattarsi altrettanto bene a una frase, una chiave segreta orienta la scelta verso una di esse. Una singola spinta non significa nulla. Ma, ripetuta centinaia di volte in un brano, crea uno schema che un rilevatore in possesso della chiave può verificare. E poiché il segnale è incorporato nelle parole stesse, resiste al copia e incolla. OpenAI ha redatto il rapporto tecnico insieme a ricercatori dell’University of Pennsylvania e di Yale. Secondo il documento, non si registra alcun impatto significativo sulla qualità: nell’Artificial Analysis Intelligence Index, i testi con la filigrana hanno ottenuto un punteggio di 49,76, contro 49,57 per quelli senza.

Lo strumento che OpenAI aveva già

Per OpenAI non c’è nulla di nuovo. Nell’estate del 2024 il Wall Street Journal aveva riferito che l’azienda disponeva di una filigrana testuale funzionante, giudicata efficace al 99,9% nei documenti interni, ma aveva deciso di non renderla disponibile. OpenAI aveva risposto di aver adottato «un approccio ponderato». Le motivazioni dichiarate erano di natura tecnica e sociale: il metodo era «facile da aggirare per malintenzionati» traducendo il testo o riformulandolo con un altro modello, e rischiava di stigmatizzare l’IA come strumento di scrittura per chi non è madrelingua inglese. Nel dare notizia dell’annuncio di questa settimana, TechCrunch ricorda una terza ragione citata all’epoca: il timore che gli utenti passassero a concorrenti che non applicavano filigrane.

Alla luce di quei precedenti, il nuovo lancio mostra quali di quelle preoccupazioni OpenAI abbia davvero affrontato. Il problema dell’elusione è ancora presente, come mostrano i dati della stessa azienda. Quello commerciale, invece, è stato confinato a un solo mercato.

I dati di OpenAI, non quelli dei suoi critici

In condizioni favorevoli e con un tasso di falsi positivi dell’1%, il rilevatore individua circa l’80% dei brani con filigrana lunghi 200 token e circa il 95% di quelli da 400. Se si sostituisce il 10% delle parole con sinonimi, il tasso di rilevamento scende dal 92% al 66%. Sostituendone un quarto, cala al 17%. Le risposte brevi, la matematica e i testi tradotti sono particolarmente difficili da individuare. OpenAI stessa avverte che buoni risultati in condizioni ideali «non garantiscono un rilevamento affidabile nell’uso quotidiano» e che l’assenza di una filigrana non dimostra che un testo sia stato scritto da una persona. Aggiunge inoltre che il contrassegno non permette di identificare l’utente.

Questo rende textGrain un segnale utile contro chi copia e incolla senza pensarci, ma poco efficace contro chi è disposto a dedicare un minuto alla revisione del testo. In un’area in cui si legge e si scrive in molte lingue, il limite legato alle traduzioni non è un dettaglio secondario.

Perché l’UE e perché adesso

La spinta normativa arriva dall’articolo 50 dell’AI Act, le cui regole sulla trasparenza sono entrate in vigore il 2 agosto. La norma impone ai fornitori di sistemi generativi di contrassegnare testi, audio, immagini e video sintetici in modo leggibile dalle macchine e di mettere a disposizione un meccanismo di rilevamento. I sistemi già sul mercato prima di quella data, tra cui ChatGPT, hanno tempo fino al 2 dicembre per adeguarsi. Le violazioni possono costare fino a 15 milioni di euro o al 3% del fatturato annuo mondiale, a seconda di quale cifra sia più alta, secondo un’analisi dello studio legale Cooley.

Due dettagli mostrano quanto il lancio segua da vicino l’obbligo normativo, più che un principio. Il primo è il rilevatore. La legge richiede un meccanismo di rilevamento; OpenAI ne ha sviluppato uno, ma lo ha affidato soltanto a ricercatori autorizzati e a organizzazioni specializzate, che devono presentare una richiesta. L’azienda afferma che allargherà l’accesso «quando riterremo che i risultati possano essere interpretati responsabilmente», riferisce The Decoder, ma non ha indicato una tempistica. Oggi un insegnante o un redattore di Lisbona o Varsavia non può verificare un testo sospetto.

Il secondo dettaglio è la geografia. Anthropic, che ha iniziato ad applicare una filigrana ai testi di Claude in agosto, la usa in tutto il mondo, indipendentemente da come le persone accedono ai suoi modelli, e per questo ha ricevuto critiche da alcuni utenti. OpenAI ha scelto la strada opposta: attivazione predefinita dove un’autorità di regolamentazione può imporre una multa, scelta lasciata agli sviluppatori altrove e nessuna attivazione globale al momento del lancio. Se il vecchio timore che gli utenti migrassero verso concorrenti senza filigrana fosse svanito, ci sarebbe ben poco motivo di tracciare la mappa in questo modo.

Che cosa succederà

OpenAI afferma che renderà textGrain open source e che il metodo eguaglia o supera approcci come SynthID di Google. Entrambe le affermazioni potranno essere verificate una volta pubblicato il codice. Per Bruxelles la questione è più circoscritta: un contrassegno che svanisce con una revisione anche leggera e che viene letto da un rilevatore che quasi nessuno può usare è sufficiente a rispettare una norma pensata perché altri sistemi possano riconoscere i testi generati dall’IA?

Dopo il 2 dicembre, gli unici utenti di ChatGPT i cui testi porteranno per impostazione predefinita la firma di OpenAI saranno quelli soggetti a un’autorità di regolamentazione in grado di presentare il conto.

Tag: , , , ,

Aggiungici su Google

Discussione

Ci sono 0 commenti.