Transparencia en IA
La marca de agua invisible de Claude está por llegar. Una reescritura completa la elimina
Anthropic añadirá una marca de agua invisible a los futuros modelos de Claude para cumplir las normas de la Ley de IA de la UE sobre el marcado de contenido generado por IA. Es gratuita e imposible de rastrear, pero pasa por alto el código exacto, los pasajes cortos y el texto completamente reescrito.
Emmanuel Fabrice Omgbwa Yasse Asistido por IA
2026-08-21 · 5 min de lectura

Los futuros modelos de Claude vendrán con una marca de agua de texto incorporada. Anthropic la describe como una forma de estimar la probabilidad de que Claude haya participado en la redacción de un pasaje determinado, y la razón declarada del cambio es la Ley de IA de la UE, que a partir del 2 de agosto exige a los proveedores de IA que sirven al mercado europeo marcar el contenido generado por IA. Anthropic firmó el Código de Conducta de la UE sobre Transparencia del Contenido Generado por IA en julio de 2026, uno de aproximadamente 190 firmantes, y está aplicando la marca de agua a nivel mundial porque todavía no tiene una forma duradera de acotarla por región.
Más interesante que el mecanismo es lo que Anthropic admite en la misma publicación. La marca de agua está pensada para ser leída a posteriori por cualquiera que tenga la clave. No está pensada para sobrevivir a alguien decidido a eliminarla. Una edición ligera probablemente no la eliminará por completo, pero una reescritura completa en la que se reemplace cada palabra sí lo hará. El requisito de marcado de la UE se está cumpliendo con una herramienta que presupone la cooperación.
Cómo funciona la marca de agua: cambiar el azar, no las palabras
Los modelos de lenguaje eligen el texto palabra por palabra a partir de una lista de candidatas. Cuando varias son igualmente sensatas, la elección se resuelve con un número aleatorio. Después de «The weather today was cold and...», la siguiente palabra no será «sugary», pero podría ser plausiblemente «overcast» o «grey». La marca de agua cambia de dónde proviene esa aleatoriedad. En lugar de un generador de números aleatorios arbitrario, Claude utiliza la clave y algunas palabras precedentes para resolver la elección. Las palabras siguen siendo aleatorias y se mantienen dentro del conjunto que Claude habría considerado de todos modos; el método nunca empuja al modelo hacia algo como «nubilous», un sinónimo oscuro que casi nadie esperaría.
El resultado es invisible para los lectores. Cualquiera que tenga la clave puede comparar la secuencia de palabras con lo que la clave produciría y asignar una probabilidad de que Claude haya generado el texto. La implementación de Anthropic es una versión de SynthID-Text, el enfoque que Google DeepMind publicó en un artículo de Nature de 2024, parte de una familia que se remonta a una propuesta de 2022 de Scott Aaronson. En el artículo de SynthID-Text, DeepMind probó la técnica en una porción del tráfico de Gemini y no encontró una diferencia estadísticamente significativa en las valoraciones positivas y negativas en comparación con un modelo sin marca de agua.
La propia analogía de Anthropic: los jugadores de un juego de mesa obtienen sus tiradas de dados de un libro de dígitos de pi en lugar de dados. El juego se desarrolla igual para todos los implicados, pero un espectador que conozca la secuencia puede deducir después que pi fue la fuente. El texto de Claude funciona de la misma manera. La experiencia es idéntica; la procedencia es comprobable.
Dónde falla la marca de agua: código exacto y texto ligeramente editado
Anthropic es explícito sobre los puntos ciegos. La detección se vuelve más fiable a medida que un pasaje crece, pero las muestras pequeñas tienen demasiadas pocas elecciones de palabras para generar confianza. El texto fáctico no le da nada a la marca de agua: después de «Isaac Newton's most famous work was called Principia», la siguiente palabra tiene que ser «Mathematica», sin ninguna alternativa igual de buena. El código es en su mayoría igual. La salida exacta no deja espacio para un empujón, así que el código generalmente lleva menos marca de agua que la prosa ordinaria; los lugares arbitrarios, como los comentarios, aún pueden marcarse.
La corrección de pruebas es otra brecha. Cuando Claude edita el texto de un humano, casi todas las palabras siguen siendo del autor, y el puñado de correcciones puede ser demasiado escaso para registrarse. Cuanto más escribe Claude, más decisiones toma y más espacio tiene la marca de agua. Las traducciones están completamente marcadas porque Claude elige cada palabra.
La marca de agua también responde a una pregunta limitada. Puede estimar la probabilidad de que Claude haya participado en algún momento, pero no puede distinguir «Claude escribió esto» de «Claude editó esto en gran medida», y no dice nada sobre propiedad o derechos de autoría.
Sin coste, sin rastreo y una API de detección en camino
El cambio está diseñado para ser barato y silencioso. La marca de agua no produce tokens adicionales y tiene un impacto insignificante en la velocidad, por lo que servir y usar Claude cuesta lo mismo. No contiene información de identificación: nada en la marca de agua o en la clave permitiría a nadie recuperar detalles sobre un usuario, su organización o sus chats.
Comprobar requiere la clave, por lo que Anthropic dice que pronto ofrecerá una API de detección de marcas de agua, con detalles de implementación aún por definir. Eso también separa la marca de agua del software de detección de IA como Pangram, que no tiene clave y funciona escaneando indicios de fraseo, los hábitos sutiles que aparecen en la salida del modelo. La detección sigue siendo una carrera armamentista con la generación, y el generador se mueve en segundo lugar, una dinámica que hemos documentado en la fábrica de contenido de IA.
Los archivos toman una ruta diferente. Cuando Claude produce un formato compatible como PNG, JPG o SVG, adjunta una credencial de contenido, una pequeña nota firmada criptográficamente en los metadatos que utiliza el estándar C2PA, el mismo que usan los fabricantes de cámaras. A diferencia de la marca de agua de texto, nada está incrustado en el archivo. Cualquier herramienta compatible con C2PA puede leer la nota, que solo registra que Claude estuvo involucrado. Los modelos antiguos de Claude, cubiertos por el período de transición de la ley de la UE para modelos lanzados antes del 2 de agosto de 2026, recibirán la marca de agua en los próximos meses.
| Método | Qué marca | Cómo se verifica | Principal limitación |
|---|---|---|---|
| Marca de agua de texto (SynthID-Text) | Palabras que Claude elige | Comprobación de patrón con clave sobre la secuencia | Se elimina con una reescritura completa |
| Credencial de contenido C2PA | Archivos que Claude produce (PNG, JPG, SVG) | Firma criptográfica leída por cualquier herramienta compatible con C2PA | Vive en los metadatos, no en los píxeles |
| Software de detección de IA (Pangram, etc.) | Cualquier texto, sin clave | Coincidencia de patrones sobre indicios de fraseo | No puede comprobar la marca de agua en sí |
Si esto satisface la intención detrás del requisito de la UE es una cuestión aparte. La marca de agua es un instrumento de cumplimiento con límites publicados. Funciona en texto largo y libre que nadie toca después. Se queda en silencio ante el código, las ediciones ligeras de escritura humana y cualquier pasaje que alguien se tome la molestia de reescribir, que es exactamente el territorio donde tiende a propagarse el contenido sintético.
- Fuente : Claude's invisible watermark is coming. A full rewrite erases it — 2026-08-13
Lo esencial de la tecnología en 3 minutos cada mañana
Un correo, cada día laborable, con lo que realmente importa en IA y tecnología.