- Anthropic utilizará una variante de SynthID-Text que modifica estadísticamente determinadas elecciones de palabras sin insertar información personal en el contenido.
- La marca permite estimar si Claude intervino en un texto, pero no demuestra por sí sola quién lo escribió ni detecta contenidos creados con otras IA.
Anthropic ha explicado con detalle cómo funcionará la futura marca de agua incorporada a los textos generados por Claude. El sistema será invisible para quien lea o copie el contenido y, según la compañía, no funciona mediante caracteres ocultos, metadatos personales ni información vinculada al usuario o a su conversación.
El mecanismo utiliza una variante de SynthID-Text, una técnica desarrollada originalmente por Google DeepMind. Los modelos de lenguaje eligen constantemente entre varias palabras posibles que pueden resultar igualmente apropiadas. La marca aprovecha esas decisiones para introducir un patrón estadístico en la secuencia de palabras sin añadir contenido externo al texto.
Quien disponga de la clave correspondiente puede analizar posteriormente ese patrón y calcular la probabilidad de que Claude haya intervenido en la generación del contenido. Esto es diferente a insertar símbolos invisibles que puedan localizarse examinando el código del documento o copiando y pegando el texto.
Anthropic insiste en que la marca tampoco contiene información que permita identificar a una persona, una organización o un chat concreto. Su finalidad es señalar la posible intervención del modelo, no rastrear quién utilizó Claude.
El sistema presenta varias limitaciones importantes. Una marca positiva puede indicar que Claude participó en el contenido, pero no distingue necesariamente entre un texto escrito completamente por la IA y otro que esta haya editado de manera sustancial. Tampoco permite determinar si un texto sin esa marca fue escrito por una persona, porque otro modelo de IA utilizaría una clave o tecnología diferente.
La fiabilidad disminuye además con textos muy breves o con fragmentos en los que apenas existen alternativas razonables entre palabras. Anthropic pone como ejemplo contenidos puramente factuales y código informático: cuando cambiar una palabra haría que una respuesta fuese incorrecta o que un programa dejara de funcionar, el sistema dispone de menos oportunidades para introducir el patrón.
Esto tiene una consecuencia práctica para quienes utilizan Claude únicamente como corrector. Si una persona escribe un documento y solicita modificar solo puntuación o pequeños errores gramaticales, la mayoría de las palabras siguen siendo humanas y puede no existir suficiente señal estadística para que la intervención de Claude resulte detectable. Una traducción generada íntegramente por el modelo sí puede contener la marca porque Claude selecciona todas las palabras del resultado.
Anthropic reconoce también que una reescritura suficientemente profunda puede destruir la señal. Los pequeños cambios no necesariamente la eliminan, pero sustituir prácticamente todas las palabras puede impedir la detección.
La compañía vincula la implantación a las obligaciones europeas de transparencia sobre contenidos generados por inteligencia artificial. Anthropic señala que aplicará inicialmente la tecnología de forma global porque todavía no dispone de un mecanismo suficientemente robusto para limitarla únicamente por regiones.
Los futuros modelos de Claude incorporarán la marca desde su lanzamiento. Para modelos anteriores al 2 de agosto de 2026 existe un periodo transitorio y Anthropic afirma que trabajará durante los próximos meses para añadir también el sistema.
Queda pendiente una parte importante para los usuarios: la herramienta de comprobación. Anthropic prepara una API que permitirá analizar un texto y determinar si contiene su patrón, pero todavía no ha comunicado una fecha concreta para su disponibilidad.
En archivos de imagen el funcionamiento será diferente. Cuando Claude produzca determinados PNG, JPG o SVG compatibles, Anthropic utilizará credenciales criptográficas C2PA almacenadas en los metadatos. Esas credenciales indican que Claude participó en la creación o procesamiento del archivo, pero tampoco incluyen información personal sobre quien utilizó el servicio.






