Rilevatore di contenuti AI
Leggi prima questo. La filigrana prevista dall'AI Act che Claude e Gemini inseriscono nel testo è statistica: è intessuta nella scelta delle parole e si legge solo con la chiave del fornitore. Nessuno strumento pubblico la rileva, nemmeno questo. Quello che questa pagina controlla è reale e verificabile: caratteri invisibili rimasti nel testo e provenienza C2PA firmata nei file.
Come funziona
Lo strumento risponde a due domande diverse su un contenuto, ed è onesto su quella a cui non può rispondere.
Cosa non può fare. Dal 2 agosto 2026 l'articolo 50 dell'AI Act europeo obbliga i fornitori di AI generativa a marcare i contenuti prodotti in un formato leggibile da una macchina. Per il *testo* Anthropic e Google lo fanno con una filigrana statistica: il modello viene spinto in scelte di parole poco rilevanti (quale sinonimo usare, come ordinare una frase) in modo che il testo finale contenga uno schema. Lo schema è invisibile a chi legge e, soprattutto, si rileva solo con la chiave che lo codifica. Nessuno strumento pubblico può leggerlo. Qualsiasi sito che dice di rilevare la filigrana di un testo di Claude o Gemini sta tirando a indovinare, e prima o poi accuserà persone che hanno scritto davvero di proprio pugno. Questo strumento non finge il contrario.
Scheda Testo: caratteri invisibili. Quello che *si può* verificare sono i residui Unicode che sopravvivono a un copia e incolla da una chat, da un CMS o da un word processor. Lo strumento esamina il testo un codepoint alla volta e segnala quattro categorie:
• Invisibili: spazio a larghezza zero (U+200B), joiner e non-joiner a larghezza zero, word joiner, BOM, trattino morbido, più i selettori di variante (U+FE00–FE0F) e i caratteri tag Unicode (U+E0000–E007F). Gli ultimi due contano per la sicurezza: non si vedono per niente ma possono codificare un contenuto nascosto qualsiasi, una tecnica chiamata ASCII smuggling usata per nascondere istruzioni in testi incollati in un agente AI. • Omoglifi: lettere cirilliche o greche identiche a una latina, per cui “password” può contenere una “а” cirillica. Vengono segnalati solo dentro una parola che contiene già lettere latine, così un vero paragrafo in russo o in greco non risulta manomesso. • Spazi anomali: spazio unificatore (U+00A0), spazio unificatore stretto (U+202F, frequente nell'output di ChatGPT attorno alla punteggiatura e dentro i numeri), spazi sottili, spazio cifra, spazio di punteggiatura e spazio ideografico. Sembrano spazi, ma fanno saltare le tue espressioni regolari. • Tipografia: lineetta, trattino medio, virgolette tipografiche, puntini di sospensione come carattere unico. È il segnale più debole della lista, perché Word, Pages e ogni CMS con la sostituzione automatica delle virgolette li producono. Sono mostrati per completezza, non come prova.
Ogni carattere trovato compare in una tabella con codepoint e numero di occorrenze, e poi nella sua posizione in un'anteprima evidenziata, dove i caratteri invisibili hanno un segnaposto visibile. Il testo ripulito elimina gli invisibili, trasforma gli spazi anomali in spazi normali e riporta gli omoglifi alla lettera latina. La tipografia resta com'è a meno che tu non spunti la casella, perché appiattirla è una scelta editoriale, non una correzione.
Scheda File: credenziali C2PA. Per i file la marcatura dell'AI Act è concreta: un manifest firmato inserito nel file stesso, secondo lo standard C2PA (Coalition for Content Provenance and Authenticity). Trascina un PNG, JPEG, WebP, SVG o PDF fino a 64 MB e lo strumento cerca il manifest nel suo contenitore (il chunk caBX nel PNG, i segmenti APP11/JUMBF nel JPEG, il chunk C2PA nel WebP), poi ne legge i campi dichiarati: il claim generator, il software agent e il digital source type IPTC, che dice se il contenuto è stato prodotto da un algoritmo addestrato.
Due limiti, detti chiaramente. Primo: lo strumento legge il manifest, non verifica la firma crittografica, perché la validazione completa richiede di controllare la catena di certificati sulla trust list C2PA, un lavoro diverso e molto più pesante. Un manifest mostrato qui è quello che il file *dichiara*, non quello che è stato *dimostrato*. Secondo: l'assenza non dimostra nulla. Uno screenshot, una ricodifica, un ridimensionamento o il caricamento su quasi tutti i social eliminano questi metadati. Il C2PA può confermare una provenienza, mai escluderla.
Tutto gira in locale: testo e file vengono letti nel browser e non vengono mai caricati.
Domande frequenti
Si può capire se un testo è stato scritto con ChatGPT o Claude?
- Non con certezza, e nessuno strumento pubblico ci riesce. La filigrana usata dai fornitori è statistica: il modello orienta le proprie scelte di parole per codificare uno schema leggibile solo con la chiave del fornitore. Anthropic ha detto di voler offrire un sistema di rilevamento, ma al momento in cui scriviamo non esiste nessuno strumento o API pubblica. Questa pagina controlla invece i residui Unicode invisibili che il testo copiato spesso si porta dietro, che sono verificabili e riproducibili.
Trovare caratteri invisibili dimostra che il testo è stato scritto dall'AI?
- No. Dimostra che il testo è passato da qualcosa che li inserisce, e oltre alle chat ci sono word processor, CMS, estrazione di testo dai PDF e strumenti di traduzione. Considera uno spazio a larghezza zero un'impronta del copia e incolla, non una confessione. L'unica categoria sospetta di per sé è il contenuto nascosto, cioè selettori di variante o caratteri tag Unicode, che nessun testo legittimo contiene.
Come si tolgono i caratteri invisibili da un testo?
- Incolla il testo e copia il riquadro Testo ripulito con il pulsante Copia il testo ripulito. Gli invisibili vengono eliminati, gli spazi anomali diventano spazi normali e gli omoglifi tornano lettere latine. Se ti serve ASCII puro, spunta Semplifica anche la tipografia: la lineetta diventa --, le virgolette tipografiche diventano dritte e i puntini di sospensione diventano tre punti.
Cos'è l'ASCII smuggling e perché conta?
- È un modo per nascondere istruzioni leggibili dentro un testo dall'aspetto normale. I caratteri tag Unicode (da U+E0000 a U+E007F) e i selettori di variante non si vedono affatto, ma ognuno può trasportare un byte, quindi si può codificare un'istruzione intera in una frase qualsiasi. Se poi incolli quella frase in un assistente AI, l'assistente legge anche i byte nascosti. Controllare il testo prima di passarlo a un agente è la difesa pratica, ed è per questo che lo strumento segnala quei blocchi come invisibili e non solo come anomali.
Perché la lineetta (em dash) è solo un segnale debole?
- Perché è l'indizio più sopravvalutato di internet. Gli LLM usano molto la lineetta, ma la usa anche chiunque abbia un buon editor, e Word trasforma in automatico un doppio trattino in una lineetta. Accusare qualcuno di usare l'AI perché il suo testo ha delle lineette è un'impressione, non una prova. La trovi qui per poterla appiattire quando ti serve ASCII semplice, non per puntare il dito.
Cosa mi dice un manifest C2PA?
- Quello che il file dichiara sulla propria storia: quale strumento l'ha generato o modificato e se il digital source type IPTC lo indica come prodotto da un algoritmo addestrato. È la marcatura leggibile da una macchina che l'articolo 50 dell'AI Act richiede per le immagini generate. Lo strumento legge questi campi dichiarati ma non verifica la firma sulla trust list C2PA, quindi prendi quello che vedi come una dichiarazione, non come una prova.
Un file non mostra nessuna provenienza. Vuol dire che è fatto da una persona?
- No, ed è il limite più importante. I metadati C2PA sono fragili per natura: uno screenshot, un nuovo salvataggio, un ridimensionamento o il caricamento sulla maggior parte dei social li eliminano del tutto. Un manifest ha significato quando c'è e non ne ha nessuno quando manca. La provenienza può confermare un'origine, mai escluderla.
Il mio testo o il mio file vengono caricati da qualche parte?
- No. Entrambe le schede funzionano interamente nel browser: il testo viene analizzato in JavaScript e i file vengono letti in memoria con la File API, senza essere inviati. Non c'è backend e nessun log. Apri la scheda Rete degli strumenti per sviluppatori mentre lo usi e non vedrai nessuna richiesta con i tuoi contenuti.