Estensione del filigrana a nuovi modelli Claude
Il 24 settembre Anthropic ha inviato una comunicazione ai clienti, confermando che a partire dal 30 settembre 2026 i modelli Claude Fable 5, Claude Sonnet 5 e Claude Opus 4.8 produrranno testi contrassegnati dal nuovo filigrana invisibile. La decisione fa parte di un piano più ampio volto a garantire che tutti i contenuti generati dalle proprie IA siano riconoscibili da sistemi automatici.
Modelli già dotati di filigrana
Secondo la panoramica dei modelli costantemente aggiornata da Anthropic, i seguenti modelli includono già il filigrana:
- Claude Fable 5.1
- Claude Mythos 5.1
- Claude Opus 5.5
- Claude Opus 5
Anthropic prevede di aggiornare anche i modelli più vecchi entro il 2 dicembre, così da uniformare la protezione su tutta la famiglia Claude. Per i modelli supportati, il filigrana viene applicato a livello di modello e non può essere disattivato dagli utenti.
Motivazione normativa: l’AI Act europeo
La spinta principale è la normativa dell’AI Act dell’Unione europea, entrata in vigore il 2 agosto. Tale regolamento impone a tutti i fornitori di sistemi di intelligenza artificiale generativa di rendere i contenuti prodotti “leggibili da macchine” e riconoscibili come generati da IA. Nonostante la normativa sia europea, Anthropic ha scelto di estendere il filigrana a livello globale su tutte le piattaforme Claude.
La tecnologia alla base del filigrana
Anthropic utilizza una propria variante della tecnologia SynthID‑Text, sviluppata da Google DeepMind. Invece di inserire caratteri invisibili o metadati, il metodo influenza la scelta tra i token plausibili durante la generazione. Su lunghi brani si forma così un pattern statistico che può essere rilevato con una chiave specifica. Secondo l’azienda, questo approccio non compromette in modo significativo la qualità del testo prodotto.
Limiti e capacità del segnale
Anthropic riconosce apertamente che il filigrana ha una “affidabilità limitata”. Un rilevamento positivo indica soltanto che Claude ha probabilmente contribuito al testo, ma non specifica in che misura. Il modello può aver tradotto, sintetizzato o modificato un documento preesistente. Operazioni di riscrittura intensiva, parafrasi, traduzioni successive o mescolamenti con altri contenuti possono indebolire o eliminare il segnale. Inoltre, per brevi estratti manca il materiale statistico necessario a generare un pattern riconoscibile, e l’assenza di filigrana non è prova che il testo sia stato scritto da un umano.
Detettore di filigrana: stato attuale
Nel mese di agosto Anthropic aveva annunciato lo sviluppo di un rilevatore di filigrana. L’API corrispondente è ora disponibile in una fase di anteprima privata, riservata a organizzazioni e singoli selezionati. Al momento non esiste ancora un servizio pubblico che consenta a chiunque di verificare la presenza del filigrana nei testi Claude.
Prospettive future e conclusioni
L’espansione del filigrana a tutti i nuovi modelli Claude segna un passo decisivo verso la trasparenza nell’uso dell’IA generativa. Se da un lato la misura soddisfa gli obblighi normativi, dall’altro evidenzia le sfide tecniche legate alla rilevabilità e alla robustezza del segnale. Il futuro potrebbe vedere ulteriori miglioramenti della tecnologia di marcatura e, possibilmente, l’apertura di un rilevatore pubblico, offrendo così a editori, ricercatori e utenti finali uno strumento più affidabile per distinguere contenuti umani da quelli prodotti da intelligenze artificiali.