I testi che ChatGPT e Codex scrivono nell'Unione europea avranno, nelle prossime settimane, un marchio invisibile. Lo ha annunciato il 5 ottobre OpenAI, l'azienda di ChatGPT. Anthropic ha introdotto ad agosto un marchio simile nei testi di Claude e lo applica in tutto il mondo. Le due aziende dicono di farlo per rispettare l'AI Act, il regolamento europeo sull'intelligenza artificiale.
Il marchio, in inglese watermark, sta nelle parole stesse. Un modello scrive scegliendo ogni volta la parola successiva fra alcune possibili. Quando più parole vanno bene, decide un numero casuale. Con il marchio quel numero viene da una chiave segreta. Chi legge vede un testo normale. Chi ha la chiave controlla quante scelte la seguono. Da lì stima la probabilità che il testo venga da quel modello. OpenAI chiama il suo sistema textGrain. Quello di Anthropic deriva da SynthID-Text, un metodo di Google DeepMind.
L'obbligo sta nell'articolo 50, comma 2, dell'AI Act, applicabile dal 2 agosto 2026. Riguarda i fornitori, cioè le aziende che offrono un sistema capace di generare testi, immagini, audio o video. I risultati devono essere marcati in un formato leggibile dalle macchine: un segnale che un programma rileva e una persona non vede. L'articolo esclude i sistemi che svolgono una «funzione di assistenza per l'editing standard» o che non cambiano in modo sostanziale il testo ricevuto. Chi viola l'obbligo rischia multe fino a 15 milioni di euro o, se è più alto, al 3 per cento del fatturato mondiale annuo, secondo l'articolo 99. Per i sistemi già sul mercato prima del 2 agosto la scadenza è il 2 dicembre 2026. L'ha aggiunta a luglio il Digital Omnibus, un pacchetto di modifiche alla legge.
Un codice di buone pratiche spiega come mettere in pratica la marcatura. È un documento di regole scritto da esperti indipendenti e pubblicato dalla Commissione europea il 10 giugno. Aderire è volontario. La Commissione e i governi, riuniti nel consiglio per l'IA, lo considerano adeguato a dimostrare la conformità. A fine luglio lo avevano firmato circa 190 organizzazioni, fra cui Anthropic.
Solo chi ha la chiave può leggere il marchio. All'inizio OpenAI apre il suo rilevatore, il programma che cerca il segnale, a ricercatori e organizzazioni esperte approvate caso per caso. Anthropic offre il proprio in anteprima privata a enti come autorità, testate, ricercatori e istituzioni educative. Ogni chiave riconosce i testi di una sola azienda. I rilevatori commerciali lavorano senza chiave: cercano nello stile le abitudini delle macchine.
Nei test pubblicati da OpenAI i brani si misurano in token, i pezzi di parola con cui il modello scrive. La soglia è fissata in modo che un testo senza marchio su cento risulti marcato per errore: è il falso positivo. Nei testi di psicologia, su brani di 400 token il rilevatore trova il marchio in circa il 95 per cento dei casi, su brani di 200 nell'80. In matematica, dove le parole possibili sono poche, va molto peggio. In un'altra prova su brani di 400 token, sostituire con sinonimi il 10 per cento delle parole fa scendere il riconoscimento da circa il 92 al 66 per cento. Con il 25 per cento si arriva al 17. Per Anthropic una parafrasi completa, cioè la stessa idea detta tutta con altre parole, cancella il marchio.
Per un insegnante, un'università o un datore di lavoro in Italia il marchio indica, al massimo, che un modello ha probabilmente scritto o rielaborato parte del testo. Vale anche se il modello ha solo tradotto. OpenAI scrive che il segnale non misura il contributo umano e non identifica l'utente. Le due aziende aggiungono che un testo senza marchio può essere stato generato lo stesso. L'articolo 50 obbliga i fornitori e, in casi elencati, chi usa questi sistemi, come chi pubblica testi per informare il pubblico. Chi corregge un compito o legge una candidatura non è fra quei casi.
Chi riceve un risultato positivo può chiedere quale rilevatore l'ha prodotto, con quale soglia di falsi positivi e su quante parole.
