Il nuovo requisito di trasparenza dell’UE

Il Regolamento IA dell’Unione Europea, entrato in vigore il 2 agosto, impone alle aziende che offrono servizi di intelligenza artificiale di contrassegnare i contenuti generati in modo che altri sistemi possano riconoscerli come prodotti da IA. Questa disposizione, nota come “regola della trasparenza”, è stata citata da OpenAI nella comunicazione ufficiale del lunedì scorso, dove l’azienda ha spiegato come intenda adempiere al mandato.

Come funziona il watermark di OpenAI

Il watermark non è un simbolo visibile, ma si manifesta attraverso una leggera manipolazione delle scelte lessicali del modello. In pratica, il sistema altera in modo impercettibile le probabilità di selezione di alcune parole, creando un pattern riconoscibile da un rilevatore dedicato. Poiché la “firma” è incorporata direttamente nel testo, essa si sposta insieme al contenuto anche quando viene copiato e incollato in altri documenti.

Caratteristiche principali

    • Invisibilità: gli utenti non percepiscono alcuna differenza di leggibilità o stile.
    • Portabilità: il segnale resta presente indipendentemente dal formato di destinazione.
    • Anonimato: il watermark non contiene informazioni sull’utente che ha generato il testo.
    • Impatto minimo: OpenAI afferma di non aver riscontrato variazioni significative nelle prestazioni dei modelli con il watermark attivo.

Piano di implementazione

Secondo il blog post dell’azienda, il rilascio avverrà nelle prossime settimane per tutti gli utenti di ChatGPT e Codex residenti nell’Unione Europea, indipendentemente dal piano di abbonamento. Per gli sviluppatori che utilizzano le API di OpenAI in qualsiasi parte del mondo, la funzionalità sarà disponibile su richiesta a partire da oggi, ma rimarrà disattivata per impostazione predefinita. OpenAI ha sottolineato che non intende rendere il watermark una impostazione globale di default al momento del lancio.

Dettagli tecnici e il rapporto “textGrain”

Contestualmente all’annuncio, OpenAI ha pubblicato un rapporto tecnico intitolato “textGrain”, co‑scritto con ricercatori dell’Università della Pennsylvania e di Yale. Il documento descrive il metodo in cui una chiave segreta ordina le previsioni della parola successiva per completare una frase. L’accumulo di centinaia di questi “spintoni” consente al rilevatore di identificare contenuti generati da IA basandosi solo sul testo e sulla chiave, senza bisogno di metadata aggiuntivi.

Limiti e possibilità di rimozione

OpenAI ha condotto test per valutare la resilienza del watermark a modifiche manuali. Sostituire il 10 % delle parole con sinonimi ha ridotto la capacità di rilevamento dal 92 % al 66 %. Inoltre, l’azienda ha osservato che passaggi brevi, risposte matematiche e testi tradotti risultano più difficili da identificare. Per questo motivo, l’accesso al rilevatore iniziale sarà riservato a ricercatori e organizzazioni esperte approvate, al fine di valutare l’affidabilità e gli usi responsabili.

Avvertenze e interpretazioni

OpenAI avverte che l’assenza di watermark non costituisce prova di autoria umana. Un testo privo di segnale potrebbe essere troppo breve, pesantemente revisionato o provenire da un’altra piattaforma di IA. Allo stesso modo, la presenza del watermark indica che una parte del contenuto è stata generata o elaborata da un sistema OpenAI, ma non quantifica il contributo umano in termini di giudizio, editing o creatività.

Contesto di mercato e reazioni

L’annuncio arriva due mesi dopo che Anthropic ha deciso di introdurre il proprio watermark sui testi prodotti da Claude, estendendolo a livello globale. La decisione di Anthropic ha suscitato critiche da parte di alcuni utenti, i quali sostenevano che il loro contributo—istruzioni, contesto, decisioni—fosse stato sminuito. OpenAI, che aveva già sperimentato un watermark interno ma aveva rimandato il suo rilascio per timori di migrazione verso concorrenti non marcati, ora sembra pronta a implementare la soluzione in risposta alle pressioni normative. Altri attori del settore, tra cui Google, Meta e Microsoft, hanno dichiarato il loro impegno a seguire il codice di condotta europeo sui contenuti generati da IA.