Claude marcará con marca de agua el “slop” de IA, incluido el texto humano editado
Puntos clave
- •Los modelos Claude lanzados en la UE a partir del 2 de agosto incluirán marcas de agua legibles por máquina desde su publicación, con planes de ampliar la tecnología a modelos más antiguos.
- •Las marcas de agua se aplicarán globalmente a todos los productos Claude compatibles, y no solo a usuarios de la UE.
- •El contenido escrito por humanos que haya sido editado, traducido o revisado por Claude también puede llevar la marca de agua, incluso cuando la obra original fue redactada de forma independiente.
- •Anthropic advirtió que el parafraseo intenso, los pasajes breves o la conversión de archivos pueden volver indetectables las marcas de agua y los metadatos, lo que limita su fiabilidad como prueba de autoría por IA.
- •Todos los principales proveedores de IA que operan en la UE, incluidos OpenAI, Google y Meta, afrontan obligaciones de marcado comparables bajo las disposiciones de transparencia de la Ley de IA.

Anthropic ha anunciado que comenzará a incorporar marcas de agua invisibles en el texto producido por sus modelos de IA Claude, en respuesta a nuevos requisitos de transparencia bajo la Ley de IA de la UE, la primera regulación integral sobre IA en el mundo. Las marcas de agua están diseñadas para facilitar la identificación del contenido generado por IA, pero el sistema también señalará texto escrito originalmente por humanos que posteriormente haya sido editado o procesado por Claude, un alcance que podría complicar los esfuerzos por determinar si el material fue creado realmente por IA.
La empresa de IA con sede en San Francisco indicó el martes que los modelos de Claude lanzados en la UE a partir del 2 de agosto incluirán marcas legibles por máquina desde su publicación. Anthropic también trabaja para ampliar esta tecnología a modelos más antiguos.
Aunque las marcas de agua se introdujeron para cumplir con la Ley de IA de la UE, Anthropic confirmó que las marcas se aplicarán en todo el mundo donde haya modelos Claude compatibles disponibles, incluidos Claude, Claude Code y su plataforma para desarrolladores.
El texto generado por los modelos llevará una marca de agua incrustada que, según Anthropic, debería mantenerse al copiar y pegar y podría sobrevivir a cierto grado de edición. Las imágenes y otros tipos de archivo compatibles llevarán metadatos firmados que indicarán que han sido procesados por Claude.
Anthropic planea publicar herramientas que permitan a los usuarios y a terceros detectar sus marcas de agua, aunque aún no se han divulgado las especificaciones técnicas.
El anuncio llega en medio de una creciente presión de reguladores y editores para que las empresas de IA hagan más identificable el contenido sintético, tras un aumento de material generado por máquinas en internet. En virtud de las disposiciones de transparencia de la Ley de IA de la UE, todos los principales proveedores de IA que operan en el bloque —incluidos OpenAI, Google y Meta— enfrentan obligaciones comparables de marcar la salida generada por IA, y varias jurisdicciones fuera de la UE, incluidos el Reino Unido y algunos estados de EE. UU., avanzan con sus propios requisitos de etiquetado de IA. City AM informó anteriormente sobre la expansión del “slop” generado por IA en las redacciones, incluidas columnas de opinión y propuestas presentadas engañosamente como trabajo de ejecutivos y otros colaboradores.
El texto escrito por humanos también podría ser señalado
Anthropic reconoció que detectar una de sus marcas de agua no significaría necesariamente que Claude haya escrito el contenido original. Un usuario podría redactar un artículo por su cuenta y luego pedir a Claude que lo revise, traduzca o edite, y el texto resultante aún podría conservar la marca de agua de Claude, incluso si el contenido y las ideas subyacentes provinieron del autor humano.
El artículo 50 de la Ley de IA de la UE establece que el requisito de marcado no se aplica cuando un sistema de IA realiza "una función de asistencia para la edición estándar" o no altera sustancialmente el material o su significado. Anthropic ha firmado el Código de Prácticas voluntario de la UE que detalla cómo las empresas pueden cumplir con las obligaciones de transparencia, pero su decisión de aplicar marcas de agua a toda la salida compatible de Claude podría abarcar material más allá de lo que exige estrictamente la legislación.
La empresa también advirtió contra el uso de las marcas como prueba definitiva de autoría por IA. Una edición intensa o el parafraseo pueden volver indetectable una marca de agua, mientras que los pasajes cortos pueden contener muy poco texto para producir una señal fiable. Los metadatos adjuntos a imágenes y otros archivos también pueden desaparecer cuando los archivos se convierten o se capturan en pantalla.
La tecnología de detección aún no es perfecta
Alex Cui, director de tecnología de la empresa de detección de IA GPTZero, escribió en X que las marcas de agua de texto suelen funcionar alterando sutilmente la probabilidad de las palabras que selecciona un modelo, creando un patrón estadístico que luego puede identificarse.
Pero dijo que la tecnología seguía siendo imperfecta, y sostuvo que las marcas de agua podrían tener dificultades para resistir un "parafraseo intenso". También advirtió que poner herramientas de detección a disposición del público podría facilitar que los usuarios descubran cómo eludirlas.
"The free paraphrasers I've tried have quickly bypassed Google DeepMind's SynthId for what it's worth", escribió.
Un estudio reciente de 1,682 adultos publicado en la revista Judgment and Decision Making encontró que los participantes calificaron las historias producidas por ChatGPT como más absorbentes y de mayor calidad que las historias escritas por humanos. Sin embargo, dieron mejores calificaciones a las historias que les dijeron que habían sido escritas por humanos. En otros dos experimentos, los investigadores no encontraron evidencia general de que los participantes pudieran distinguir de forma fiable entre historias escritas por humanos y por IA.
Anthropic dijo que su marca de agua no alterará visiblemente la salida de Claude ni afectará su significado o legibilidad. La empresa admitió que el sistema proporcionará una señal, no una prueba concluyente, sobre el origen de una pieza de contenido, dejando a empresas o editores decidir cuánto peso dar a las nuevas marcas.