internettoolbox
← Volver a las herramientas

Detector de contenido de IA

Lee esto primero. La marca de agua prevista por el Reglamento de IA de la UE que Claude y Gemini insertan en el texto es estadística: está tejida en la elección de las palabras y solo se lee con la clave del proveedor. Ninguna herramienta pública la detecta, tampoco esta. Lo que comprueba esta página es real y verificable: los caracteres invisibles que quedan en el texto y la procedencia C2PA firmada en los archivos.

Cómo funciona

Esta herramienta responde a dos preguntas distintas sobre un contenido, y es sincera sobre la que no puede responder.

Lo que no puede hacer. Desde el 2 de agosto de 2026, el artículo 50 del Reglamento de IA de la UE obliga a los proveedores de IA generativa a marcar sus resultados en un formato legible por máquinas. Para el *texto*, Anthropic y Google lo aplican como una marca de agua estadística: se empuja al modelo en decisiones de poco peso al elegir palabras (qué sinónimo usar, cómo ordenar una oración) para que el texto final lleve un patrón. Ese patrón es invisible para quien lee y, sobre todo, solo lo detecta quien tiene la clave que lo codifica. Ninguna herramienta pública puede leerlo. Cualquier sitio que diga detectar la marca de agua de un texto de Claude o de Gemini está adivinando, y sus conjeturas acabarán acusando a personas que escribieron de verdad. Esta herramienta no finge lo contrario.

Pestaña Texto: caracteres invisibles. Lo que *sí* se puede verificar son los restos de Unicode que sobreviven a copiar y pegar desde un chat, un gestor de contenidos o un procesador de texto. El escáner recorre tu texto punto de código a punto de código y señala cuatro clases:

• Invisibles: espacio de ancho cero (U+200B), joiner y non-joiner de ancho cero, word joiner, BOM, guion blando, además de los selectores de variación (U+FE00–FE0F) y los caracteres de etiqueta Unicode (U+E0000–E007F). Los dos últimos importan por seguridad: no se ven en absoluto, pero pueden codificar una carga oculta arbitraria, una técnica llamada ASCII smuggling que se ha usado para esconder instrucciones en texto pegado en un agente de IA. • Homóglifos: letras cirílicas o griegas que se ven idénticas a una latina, de modo que “contraseña” puede contener una “а” cirílica. Solo se señalan dentro de una palabra que ya contiene letras latinas, así que un párrafo genuino en ruso o en griego no se marca como manipulado. • Espacios anómalos: espacio de no separación (U+00A0), espacio fino de no separación (U+202F, frecuente en la salida de ChatGPT junto a la puntuación y dentro de los números), espacios finos, numéricos, de puntuación e ideográficos. Parecen un espacio, se ordenan como un espacio y rompen tu expresión regular como nada más. • Tipografía inteligente: raya, semirraya, comillas tipográficas y el carácter de puntos suspensivos. Es la señal más débil de la lista, porque Word, Pages y cualquier gestor de contenidos con sustitución de comillas también los producen. Se muestran por completitud, no como prueba.

Cada hallazgo aparece con su punto de código y su número de apariciones, y después en su posición dentro de una vista previa resaltada donde los caracteres invisibles tienen un sustituto visible. El texto limpio elimina los invisibles, normaliza los espacios anómalos a un espacio normal y devuelve los homóglifos a su letra latina. La tipografía inteligente se deja como está salvo que marques la casilla, porque aplanarla es una decisión editorial, no una corrección.

Pestaña Archivo: credenciales C2PA. En el caso de los archivos, el marcado del Reglamento de IA es concreto: un manifiesto firmado incrustado en el propio archivo, según el estándar C2PA (Coalition for Content Provenance and Authenticity). Suelta un PNG, JPEG, WebP, SVG o PDF y la herramienta localiza el manifiesto en su contenedor (el chunk caBX en PNG, los segmentos APP11/JUMBF en JPEG, el chunk RIFF C2PA en WebP) y lee de él los campos declarados: el generador de la declaración, el agente de software y el tipo de fuente digital IPTC que indica si el contenido lo produjo un algoritmo entrenado.

Dos límites, dichos con claridad. Primero, esto lee el manifiesto, no verifica criptográficamente la firma: la validación completa exige recorrer una cadena de certificados contra la lista de confianza de C2PA, que es un trabajo distinto y mucho más pesado. Un manifiesto mostrado aquí es lo que el archivo *declara*, no lo que está *demostrado*. Segundo, la ausencia no prueba nada: una captura de pantalla, una recodificación, un cambio de tamaño o una subida a casi cualquier red social eliminan estos metadatos sin dejar rastro. C2PA puede confirmar la procedencia, pero nunca descartarla.

Todo se ejecuta en local. Tu texto y tus archivos se leen en el navegador y nunca se suben.

Preguntas frecuentes

¿Puede detectar la marca de agua del Reglamento de IA en un texto de Claude o de ChatGPT?

No, y tampoco puede ninguna otra herramienta pública. La marca de agua de texto que usan los proveedores es estadística: el modelo sesga sus propias elecciones de palabras para codificar un patrón que solo se lee con la clave del proveedor. Anthropic ha dicho que planea ofrecer detección, pero en el momento de escribir esto no existe ninguna herramienta ni API pública de detección. Lo que comprueba esta página es en cambio el residuo Unicode invisible que suele llevar el texto copiado, que es verificable y reproducible.

¿Encontrar caracteres invisibles demuestra que un texto lo escribió una IA?

No. Demuestra que el texto pasó por algo que los inserta, y eso incluye los chats, pero también los procesadores de texto, los gestores de contenidos, la extracción de PDF y las herramientas de traducción. Trata un espacio de ancho cero como la huella de un copiar y pegar, no como una confesión. La única clase que resulta sospechosa por sí sola es la carga oculta, es decir, los selectores de variación o los caracteres de etiqueta Unicode, que nada legítimo pone en prosa.

¿Qué es el ASCII smuggling y por qué importa?

Es una forma de esconder instrucciones legibles dentro de un texto de apariencia normal. Los caracteres de etiqueta Unicode (U+E0000 a U+E007F) y los selectores de variación no se ven en absoluto, pero cada uno puede llevar un byte, así que alguien puede codificar una instrucción completa dentro de una frase que parece perfectamente normal. Si luego pegas esa frase en un asistente de IA, este lee los bytes ocultos junto con los visibles. Escanear el texto pegado antes de dárselo a un agente es la defensa práctica, y por eso esta herramienta marca esos rangos como ocultos y no solo como raros.

¿Por qué la raya cuenta solo como una señal débil?

Porque es el indicio más sobrevalorado de internet. Los LLM usan mucho la raya, pero también la usa cualquier autor con un buen editor, y Word convierte un doble guion en una automáticamente. Acusar a alguien de usar IA porque su texto tiene rayas es reconocer patrones, no aportar pruebas. Aparece en la lista para que puedas aplanarla cuando necesites ASCII sencillo, no para que la señales con el dedo.

¿Qué me dice realmente un manifiesto C2PA?

Te dice lo que el archivo declara sobre su propia historia: qué herramienta lo generó o lo editó, cuándo, y si el tipo de fuente digital IPTC lo marca como producido por un algoritmo entrenado. Es el marcado legible por máquinas que exige el artículo 50 del Reglamento de IA para las imágenes generadas. Esta herramienta lee esos campos declarados; no verifica la firma contra la lista de confianza de C2PA, así que trata lo que ves como una declaración y no como una prueba.

Un archivo no muestra procedencia. ¿Significa que lo hizo una persona?

No, y esta es la limitación más importante. Los metadatos C2PA son frágiles por diseño: hacer una captura de pantalla, volver a guardar, cambiar el tamaño o subir a la mayoría de las redes sociales los elimina por completo. Por eso un manifiesto es significativo cuando está presente y no significa nada cuando falta. La procedencia puede confirmar el origen, nunca descartarlo.

¿Se sube mi texto o mi archivo a algún sitio?

No. Las dos pestañas se ejecutan por completo en tu navegador: el texto se escanea en JavaScript y los archivos se leen en memoria con la File API y no se envían a ninguna parte. No hay backend ni registros. Abre la pestaña Red de las herramientas para desarrolladores mientras la usas y no verás ninguna petición con tu contenido.

Cambiar de herramienta

Busca y abre cualquier herramienta