Anthropic anunció que los futuros modelos de Claude generarán textos con una marca de agua destinada a estimar la probabilidad de que el asistente haya participado en su creación. La compañía implementará esta tecnología para cumplir con las exigencias de transparencia vinculadas al AI Act de la Unión Europea.

Claude utilizará una variante de SynthID-Text
El sistema no introduce símbolos, caracteres ocultos ni información adicional dentro de las respuestas. Anthropic señala que tampoco requiere tokens adicionales, por lo que su implementación no debería modificar el costo ni producir un impacto relevante en la velocidad de generación.
La tecnología modifica determinadas elecciones que realiza el modelo entre palabras igualmente apropiadas durante la generación. Estas decisiones producen un patrón imperceptible para el lector, pero que puede ser detectado posteriormente mediante una clave asociada al sistema.
La marca de agua de Claude está basada en una versión de SynthID-Text, una tecnología desarrollada por Google DeepMind y publicada en 2024. Según Anthropic, sus pruebas internas no mostraron efectos sobre el contenido, la creatividad o la legibilidad de las respuestas generadas.
El mecanismo tampoco permite identificar a una persona, organización o conversación específica. Su detección únicamente permite estimar la probabilidad de que Claude haya intervenido en la generación o edición de determinado contenido.

La detección dependerá del tipo y extensión del texto
La efectividad del sistema dependerá de la cantidad y del tipo de texto analizado, debido a que los fragmentos breves entregan menos información para identificar el patrón. La marca también tendrá menor presencia en contenidos factuales, correcciones menores y código, donde existen menos alternativas válidas para modificar la elección de palabras.
Una traducción realizada completamente por Claude sí podrá incorporar la marca porque el modelo selecciona todas las palabras del resultado. En cambio, una revisión limitada a gramática y puntuación puede contener una señal insuficiente para detectar de manera confiable su intervención.
Anthropic informó además que ofrecerá una API destinada a comprobar si un texto contiene su marca de agua, aunque todavía no detalló cuándo estará disponible. La compañía también trabaja para incorporar este mecanismo en modelos anteriores a agosto de 2026 durante los próximos meses.

Para archivos compatibles como PNG, JPG y SVG, Claude utilizará credenciales de contenido basadas en el estándar C2PA en lugar de la misma técnica aplicada al texto. La información quedará registrada mediante metadatos firmados criptográficamente que indicarán que Claude participó en la creación o procesamiento del archivo.


