// MACITYNET — INTELLIGENZA ARTIFICIALE
Anche ChatGPT avrà una filigrana per i testi generati nell’Unione Europea
Questo sito contiene link di affiliazione per cui può essere compensato
Fatta la legge, trovato l’inganno, dicevano i nostri nonni. Ad esempio: sostituire con sinonimi il 10% delle parole di un brano di 400 token porta il tasso di rilevamento della filigrana di OpenAI da circa il 92% al 66%. Con il 25% di parole cambiate il rilevamento scende al 17%. Sono i numeri forniti dell’azienda stessa, resi noti insieme all’annuncio dello scorso lunedì 5 ottobre.
Nelle prossime settimane ChatGPT e Codex inizieranno a marcare con textGrain i testi idonei prodotti nell’Unione europea. Quasi negli stessi giorni, in Francia, è bastato il giudizio di un software (peraltro di intelligenza artificiale) per togliere un romanzo dalla corsa a un premio e rovinare (o quasi) la carriera di uno scrittore. Ma andamo in ordine, perché l’argomento è più complesso di quel che sembra.
Cominciamo a spiegare cosa fa adesso l’azienda di Sam Altman. OpenAI descrive textGrain come un segnale statistico che altera in modo impercettibile le scelte di parole del modello. Il lettore non vede alcuna etichetta: un rilevatore verifica se il brano segue lo schema definito da una chiave segreta. Proprio come aveva annunciato questa estate Anthropic che vuole mettere il watermark, la filigrana, alle frasi scritte da Claude.
La spinta viene dall’articolo 50 del regolamento europeo sull’intelligenza artificiale (AI Act), applicabile dal 2 agosto 2026, che impone ai fornitori di marcare i contenuti sintetici, testo compreso, in modo leggibile da una macchina. I sistemi già sul mercato hanno tempo fino al 2 dicembre.
La filigrana per l’Unione europea riguarda gli utenti di ChatGPT con qualunque piano. I clienti delle API nel resto del mondo potranno attivarla su alcuni modelli, ma resta spenta per impostazione predefinita. Ovviamente la filigrana deve essere “segreta” e quindi è necessario uno strumento per poterla rilevare, altrimenti non servirebbe a nulla. All’inizio il rilevatore sarà riservato a ricercatori e organizzazioni di esperti approvati, e OpenAI dice di voler rilasciare textGrain come software open source. Nel 2024 l’azienda ne aveva sviluppata una e aveva scelto di non distribuirla.
Ad agosto, come abbiamo detto, Anthropic ha annunciato una filigrana per i testi di Claude, applicata ai modelli supportati su scala globale e non solo per gli utenti europei, con una variante di SynthID-Text di Google DeepMind, secondo Campus Technology. Anche Google marca già i testi con SynthID, e OpenAI sostiene che textGrain lo abbia eguagliato o superato nei test interni. Le strade secondo gli analisti differiscono per ampiezza, ma la direzione è la stessa: i grandi laboratori adottano la stessa tecnica perché una norma la richiede.
Quello che la filigrana non può dire però è cosa è successo veramente a un testo. OpenAI, infatti, avverte che il rilevamento può sbagliare e che modificare o tradurre un testo indebolisce il segnale. Una filigrana, precisa l’azienda, non identifica l’utente, non rivela i prompt, non verifica l’accuratezza né stabilisce la proprietà del testo, e la sua assenza non dimostra che il testo sia umano.
Il segnale è quindi asimmetrico: può suggerire che un brano sia passato da un modello, non può certificare che sia stato scritto da una persona, e dice sempre meno quanto più il testo viene rimaneggiato.
Facciamo degli esempi. Per chi usa l’AI soltanto per la revisione finale, con correzioni grammaticali, punteggiatura, una frase da riformulare, la situazione diventa molto scomoda. Quello che è sostanzialmente un correttore ortografico avanzato si trasforma in un pericoloso strumento che potrebbe provocare dei guai all’autore umano. Infatti, il modello restituisce il testo parola per parola, e ciò che restituisce può portare il segnale della filigrana. OpenAI non spiega come textGrain si comporti con una pagina umana ritoccata dalla macchina, né quale quota di parole basti a farlo scattare. Stando ai suoi test, l’unico modo di far sparire la tr