


La filigrana di Claude mostra il limite delle iniziative che affidano a un marchio tecnico il compito di distinguere la parola umana da quella artificiale. Aggirabile da chi vuole ingannare e penalizzante per chi usa l’IA in buona fede, il nuovo sigillo rischia di sostituire il giudizio senza offrire una vera prova.
Il 10 agosto 2026 un tweet dell’account di Polymarket ha superato i 7 milioni di visualizzazioni con una sola frase: Claude inserirà «d’ora in poi» una filigrana invisibile nel testo generato dall’intelligenza artificiale, così che possa essere rilevato anche dopo essere stato copiato e incollato.

La notizia ha un fondamento reale, ma il tweet la comprime fino a deformarla. Anthropic si è impegnata a dotare di una marcatura leggibile dalle macchine ogni nuovo modello Claude lanciato nell’Unione europea dal 2 agosto 2026. L’estensione ai modelli precedenti è ancora in corso e gli strumenti con cui utenti e terze parti potranno rilevare il segnale non sono ancora disponibili. La marcatura, quando presente, sarà applicata a livello del modello e funzionerà in tutto il mondo, ovunque siano offerti i modelli supportati.
La reazione si è divisa, come spesso accade, in due tifoserie. Da una parte chi festeggia: finalmente uno strumento per smascherare la scrittura artificiale, difendere la scuola dai compiti fatti dal chatbot e il giornalismo dai testi sintetici. Dall’altra chi denuncia: sorveglianza, tracciamento, fine dell’anonimato digitale. Le due narrazioni sembrano opposte, ma condividono lo stesso difetto: attribuiscono alla tecnologia più di quanto la tecnologia, almeno per ora, prometta di fare.
Che cosa dice davvero Anthropic
La decisione nasce dalle nuove regole europee sulla trasparenza dei contenuti generati dall’intelligenza artificiale. Gli obblighi previsti dall’articolo 50 dell’AI Act sono vincolanti; il Codice di condotta firmato da Anthropic è invece uno strumento volontario con cui i fornitori possono dimostrare di rispettarli. La filigrana è la soluzione tecnica scelta dall’azienda per tradurre quegli impegni in pratica.
Secondo la documentazione pubblicata da Anthropic, i modelli supportati intrecceranno nel testo un segnale impercettibile, senza modificarne il significato, la qualità o la leggibilità. Poiché il marchio fa parte del testo e non del file che lo contiene, lo segue quando viene copiato e incollato e può resistere ad alcune modifiche. Per i file grafici supportati, come SVG, PNG e JPG, Claude userà invece metadati di provenienza firmati secondo lo standard C2PA.
Qui finiscono le certezze. Anthropic non ha ancora pubblicato le specifiche tecniche della filigrana né i dati sulla sua affidabilità. Non sappiamo con quale frequenza produca falsi positivi e falsi negativi, quanto testo serva per ottenere un risultato attendibile o quante modifiche possa sopportare prima che il marchio smetta di essere rilevabile. Sappiamo però che la stessa azienda invita a non trattarla come una prova.
Processato non significa scritto
Il punto più delicato sta in un verbo. Un marchio rilevato indica che il contenuto potrebbe essere stato processato da Claude, non che Claude ne sia l’autore. L’azienda lo dice esplicitamente: il segnale non stabilisce da solo la provenienza completa del testo.
Si pensi a uno scrittore che compone il proprio articolo, parola per parola, e poi lo affida al modello per correggere alcuni refusi. Il testo è di concezione e stesura umana, ma l’output può portare la filigrana. Lo stesso può accadere dopo una traduzione, un riassunto o una conversione di formato. Il marchio testimonia un passaggio, non assegna una paternità.
Vale anche il contrario. L’assenza del segnale non dimostra che un testo sia umano. La marcatura può mancare perché il contenuto proviene da un modello precedente, perché il brano è troppo corto o perché è stato ampiamente riscritto, tradotto o mescolato con altro materiale. E naturalmente può essere stato generato da un sistema che non utilizza alcuna filigrana.
Se il marchio verrà promosso da indizio a verdetto, vedremo studenti accusati di aver delegato un compito al chatbot soltanto per aver usato un correttore, e autori costretti a dimostrare un negativo. Se la sua assenza verrà scambiata per una garanzia, vedremo testi sintetici circolare con un’impossibile patente di autenticità. Il segnale può ridurre l’incertezza solo se resta un elemento dell’indagine; usato come prova autosufficiente, trasforma l’incertezza in falsi verdetti.
La sorveglianza che, per ora, non c’è
Anche la narrazione opposta legge nel marchio qualcosa che Anthropic non ha annunciato. Una filigrana nel testo non è, di per sé, un trasmettitore: non comunica la posizione di chi scrive e non «telefona a casa» quando il contenuto viene copiato. Nella documentazione disponibile non c’è alcuna indicazione che il segnale codifichi l’identità dell’utente, l’account o la singola conversazione. Indica, quando viene rilevato, un possibile passaggio attraverso Claude.
La prudenza resta necessaria. Finché Anthropic non pubblicherà il sistema di rilevamento e le specifiche tecniche, non sarà possibile valutarne tutte le implicazioni. Se, per esempio, la verifica richiedesse di inviare un documento a un servizio esterno, sorgerebbero problemi di riservatezza distinti dalla filigrana stessa. Ma parlare già oggi di tracciamento individuale o di fine dell’anonimato significa confondere un marchio di provenienza con un identificatore personale.
Il rischio più concreto non è che la filigrana insegua segretamente gli utenti. È che scuole, aziende, redazioni e piattaforme le facciano dire ciò che non può dire, trasformando un segnale probabilistico in uno strumento disciplinare.
Il lavaggio del testo
Anthropic descrive la filigrana come un segnale intrecciato nel testo durante la generazione, ma non ha spiegato come funzioni. È verosimile che si tratti di uno schema statistico nelle scelte linguistiche del modello: non un’etichetta attaccata al documento, ma una regolarità distribuita nella sequenza. È un’ipotesi ragionevole, non ancora una caratteristica confermata del sistema di Claude.
La conseguenza pratica, invece, è già ammessa dall’azienda: una riscrittura profonda, una traduzione o una parafrasi possono rendere il marchio non rilevabile. Nella ricerca sulle filigrane testuali, gli attacchi di riscrittura sono un problema noto; alcuni studi hanno mostrato che sistemi di marcatura esistenti possono essere neutralizzati conservando in larga parte il significato del testo. Non sappiamo ancora quanto il sistema di Claude sia resistente a questi attacchi, perché il suo metodo e il suo rilevatore non sono pubblici.
L’incentivo perverso, tuttavia, è evidente. Chi usa il modello normalmente, magari solo per correggere o tradurre, non ha motivo di alterarne l’output e conserverà il segnale. Chi vuole nascondere deliberatamente l’origine artificiale del testo sarà anche il più motivato a riscriverlo fino a cancellarlo. La marcatura pesa quindi soprattutto sull’uso ordinario, mentre mette alla prova la propria robustezza proprio contro chi ha interesse ad aggirarla.
Questo non la rende inutile. La rende inadatta al ruolo di arbitro che molti vorrebbero assegnarle.
La vecchia paura della parola nuova
Resta un paradosso istituzionale: la norma è europea, ma Anthropic ha deciso di applicare la marcatura ai modelli supportati in tutto il mondo. È un classico effetto Bruxelles: una regola regionale che diventa uno standard globale perché mantenere sistemi diversi per ogni giurisdizione può essere più costoso e complesso che estendere a tutti la soluzione più esigente.
Sotto la cronaca regolatoria si muove però un riflesso molto più antico. Nel Fedro di Platone, il dio Theuth presenta al re Thamus l’invenzione della scrittura come un rimedio per la memoria e la sapienza. Thamus risponde che produrrà l’effetto opposto: gli uomini, affidandosi ai segni esterni, eserciteranno meno la memoria e possederanno l’apparenza della sapienza più che la sapienza stessa.
Da allora, ogni rivoluzione della parola ha generato timori che contenevano almeno un grano di verità. La stampa trasformò l’autorità religiosa e politica; il romanzo cambiò l’immaginazione e i costumi; la televisione modificò il rapporto con la lettura; internet ha rimodellato l’attenzione. L’intelligenza artificiale non è semplicemente la replica di quelle tecnologie, e ricordare i precedenti non basta ad assolverla. L’analogia serve a riconoscere una tentazione istituzionale ricorrente: quando non si può fermare un nuovo strumento della parola, si prova a classificarne i prodotti con un sigillo.
L’imprimatur ecclesiastico fu un antenato culturale di questa aspirazione: non una filigrana tecnica, ma un marchio che separava la parola autorizzata da quella sospetta. La marcatura di Anthropic ne rovescia il verso. Non certifica il testo approvato; segnala quello che potrebbe essere passato attraverso una macchina.
La domanda decisiva, allora, non è soltanto se sia giusto marcare il testo generato dall’intelligenza artificiale. È che cosa siamo disposti a far dire a quel marchio. Un segnale che indica un transito e non una paternità può essere utile finché viene letto per ciò che è; diventa pericoloso quando la pigrizia interpretativa lo promuove a verdetto.
La tecnologia, ancora una volta, è la parte facile. La parte difficile è la disciplina di chi la userà per giudicare il lavoro degli altri. E quella disciplina, da Thamus in poi, non è mai stata incorporata in nessun sigillo.
Inserisci la tua mail per non perdere nessuno dei contenuti di InOltre. Ogni volta che pubblicheremo qualcosa sarete i primi a saperlo.
*Iscrivendoti alla nostra newsletter accetti la nostra privacy policy

Il Club InOltre nasce per creare una community tra chi InOltre lo scrive, chi lo legge e chi lo sostiene. È il desiderio di creare punti di incontro digitali e, quando possibile, anche fisici – dove scambiarsi idee, discutere, conoscersi da vicino.
Un Club che unisce tutti quelli che contribuiscono alla buona riuscita d’InOltre e al suo successo.
InOltre è completamente gratuito ed è il frutto della competenza e della passione di molte persone che lavorano senza fini di lucro. Se desideri contribuire con un piccolo supporto, puoi farlo effettuando un bonifico come di seguito specificato oppure cliccando sui pulsanti che vedi, scegliendo l’opzione che più preferisci. Le donazioni verranno utilizzate per i costi di mantenimento del sito e per altre attività editoriali.
Grazie per il vostro supporto!
Bonifico bancario intestato a Inoltre Ente del Terzo Settore con Causale: donazione/erogazione liberale a favore di Inoltre ETS.
Codice Iban: IT55A0306909606100000404908



Scopri di più da InOltre
Abbonati per ricevere gli ultimi articoli inviati alla tua e-mail.
