Anthropic responde: así funciona la marca de agua SynthID-Text en Claude
Anthropic publicó este viernes una entrada en su blog para responder preguntas básicas sobre cómo aplicará marcas de agua al texto generado por Claude, su chatbot de inteligencia artificial. La medida busca cumplir con el Código de Transparencia de la Ley de IA de la UE, que exige a las empresas de IA usar sistemas capaces de identificar el contenido generado por IA.
“El marcado de agua no afecta la calidad del resultado de Claude. Para un lector, una respuesta con marca de agua es indistinguible de una sin marca.” — Anthropic

¿Cómo funciona el marcado de agua?
La nueva explicación comienza con un panorama general: al tomar decisiones de bajo riesgo, como elegir entre “overcast” y “grey” para describir el clima, Claude puede crear un patrón en sus respuestas que es indetectable para el lector, pero detectable para cualquiera que tenga una clave que lo codifique.
SynthID-Text y la API de detección
Anthropic utilizará el enfoque SynthID-Text que el equipo de Google DeepMind presentó en 2024, y planea lanzar una API de detección de marcas de agua.
La compañía aclara que el marcado de agua es diferente de los enfoques de detección de IA que ofrecen empresas como Pangram, las cuales buscan “pistas” en la escritura, como construcciones del tipo “esto no es [X], es [Y]”, para revelar el uso de IA: “Detectar estos patrones es fundamentalmente diferente de verificar una marca de agua.”
¿Se puede eliminar la marca de agua editando el texto?
Anthropic dijo que es posible, pero “la edición ligera probablemente no eliminará la marca de agua por completo”, mientras que “una reescritura completa en la que cada palabra sea reemplazada sí lo hará”. En ese último caso, la empresa señala que es discutible si el texto puede seguir describiéndose como generado por IA.
Claude como corrector o coeditor
Si el texto solo fue corregido o editado por Claude, la detección dependerá de la longitud del texto y de cuánto lo haya editado Claude. Si solo se editó ligeramente, casi todas las palabras habrán sido escritas por el autor humano y habrá muy poco, o nada, a lo que la marca de agua pueda adherirse.
¿Qué ocurre con el código?
El código generado tendrá menos marca de agua que otro texto, porque el modelo necesita crear código funcional y no tendrá la libertad de elegir entre una variedad de opciones igualmente válidas. Sin embargo, en áreas donde existe una elección arbitraria entre palabras o términos dentro del código, como en los comentarios, la marca de agua puede usarse. Según Anthropic, por definición, tendrá un efecto insignificante en el código producido.
Debate entre los usuarios de Claude
La decisión ya generaba debate entre los usuarios desde que la compañía la dio a conocer a principios de esta semana. En Reddit, un usuario calificó la medida como una conspiración contra los usuarios inocentes de Claude, mientras que otro afirmó: “La única razón por la que no querrías esto es para mentirle a la gente”. En X, docenas de usuarios aseguraron haber cancelado sus suscripciones a Claude como resultado.
No será solo Claude
Anthropic también señaló que Claude no será el único chatbot de IA en generar texto con marca de agua: otros grandes desarrolladores de modelos han firmado el mismo Código de Práctica e implementarán sus propias marcas de agua.