Legal

Marca de agua; arma de doble filo

Lo que se ha medido es SynthID-Text sobre un modelo de pesos abiertos, no la marca de agua de Claude, y trasladarlo a Anthropic es una inferencia: hecha esa salvedad, quienes probaron ese esquema consiguieron en una parte de los intentos el camino inverso al previsto, colar un texto humano como si lo hubiera escrito la máquina. Desde el 1 de septiembre, los modelos de Claude publicados tras el 2 de agosto marcan cuanto escriben con una señal que solo Anthropic sabe leer. Quien sufriera esa atribución falsa solo podría recurrir ante quien lo acusa.

Recibe el resumen diario de IA

Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

Frecuencia:

Un puño clava un cuchillo en el centro de una hoja impresa, justo sobre el asterisco de Anthropic marcado en naranja encima del texto, con un hilo de sangre resbalando por la hoja.
📷 Imagen generada con IA

En resumen

  • Anthropic explicó cómo funciona la marca el 14 de agosto de 2026 y la llevan los modelos publicados después del 2 de agosto; los primeros, Fable 5.1 y Mythos 5.1, salieron el 1 de septiembre.
  • El SRI Lab de la ETH de Zúrich midió en 2024 un 4 % de éxito al suplantar SynthID-Text y más del 90 % al borrarlo.
  • El artículo 50(2) del Reglamento de IA europeo rige desde el 2 de agosto de 2026 y se sanciona con hasta el 3 % de la facturación mundial.
  • Un preprint del 9 de septiembre avisa: nadie ajeno a la empresa puede inspeccionar la configuración desplegada.

La marca está activa desde el 1 de septiembre y se aplica en todo el mundo

Anthropic, la empresa estadounidense que desarrolla Claude, explicó el 14 de agosto de 2026 cómo funciona su marca de agua de texto. La llevan los modelos publicados después del 2 de agosto: en la práctica, desde el 1 de septiembre, con Fable 5.1 y Mythos 5.1, reservado este último a organizaciones estadounidenses verificadas. El resto del catálogo sigue pendiente.

El marcado se aplica en todos los productos de Claude y en todo el mundo: Anthropic dice que aún no sabe limitarlo por regiones. La API que lo detecta es de acceso restringido.

Leer más: Anthropic — «How Claude's text watermark works» ↗

Suplantar la marca cuesta caro y deja rastro; borrarla es fácil

Qué se ha medido, sobre qué sistema y quién lo midió
Lo que se mide Resultado Quién lo midió Sobre qué sistema
Suplantar la marca con los parámetros por defecto 4 % SRI Lab, ETH de Zúrich SynthID-Text sobre Llama2-7B
Suplantarla triplicando las consultas (de 30.000 a 90.000) 15 % SRI Lab, ETH de Zúrich SynthID-Text sobre Llama2-7B
Borrar la marca Más del 90 % SRI Lab, ETH de Zúrich SynthID-Text sobre Llama2-7B
Borrarla robando antes la marca Cerca del 100 % SRI Lab, ETH de Zúrich SynthID-Text sobre Llama2-7B
Eficacia de la herramienta que OpenAI archivó ~99,9 % OpenAI, según documentos internos citados por el WSJ Evaluación interna, nunca publicada
Ninguna de estas mediciones se ha hecho sobre el sistema que Anthropic tiene desplegado: las de la ETH de Zúrich se hicieron sobre la implementación pública de SynthID-Text y un modelo de pesos abiertos. El propio trabajo concluye que SynthID-Text es más difícil de suplantar que los esquemas anteriores, y que los intentos dejan rastro.

Lo midieron Nikola Jovanović, Thibaud Gloaguen y Martin Vechev, del SRI Lab de la ETH de Zúrich —Secure, Reliable and Intelligent Systems Lab, el grupo de investigación en aprendizaje automático fiable y seguro del Departamento de Informática de la escuela politécnica federal suiza—, el 20 de diciembre de 2024, en una entrada de blog sin revisión por pares.

Los matices pesan tanto como las cifras. Se probó sobre la implementación pública de SynthID-Text y un modelo de pesos abiertos, Llama2-7B, no sobre Claude: trasladarlo a Anthropic es una inferencia. Los autores concluyen que SynthID-Text resiste la suplantación mejor que los esquemas anteriores —ese 4 % es un listón alto, no un suspenso— y que los intentos dejan pistas. Borrarla es otra historia.

El contrapunto de la tabla no es europeo: OpenAI tenía lista en 2024 una marca para texto y no la publicó, entre otras razones porque podía estigmatizar a los hablantes no nativos de inglés.

Leer más: SRI Lab, ETH de Zúrich — «Probing Google DeepMind's SynthID-Text Watermark» ↗

Nadie de fuera puede inspeccionar el sistema que está funcionando

Un preprint del 9 de septiembre de 2026, firmado en arXiv por Alexander Nemecek, Vipin Chaudhary y Erman Ayday, de la Case Western Reserve University, universidad privada estadounidense, sostiene que hoy no se pueden verificar ni las objeciones ni las garantías, y que esa imposibilidad, y no la marca, es el fallo de gobernanza. Nadie ajeno a la empresa puede inspeccionar la configuración desplegada, y es ella quien calibra el detector y arbitra las disputas.

Ahí la suplantación deja el laboratorio: quien vea su texto atribuido por error al modelo solo puede impugnarlo con las herramientas de quien produjo la acusación. Y esas pruebas no serían caras: su ausencia es una decisión.

Leer más: Nemecek, Chaudhary y Ayday — arXiv:2609.09604 ↗

La ley europea obliga a marcar y castiga con el 3 % de la facturación mundial

Saltarse esa obligación figura entre las infracciones del artículo 99: hasta 15 millones de euros o el 3 % del volumen de negocios mundial, la cifra que sea mayor; para una empresa como Anthropic, manda el 3 %. Los sistemas comercializados antes del 2 de agosto de 2026 tienen hasta el 2 de diciembre, por una disposición transitoria del Digital Omnibus que afecta a todo el sector.

Anthropic firmó además en julio el Código de Prácticas sobre Transparencia, que a finales de mes habían suscrito unas 190 organizaciones: 82 firmas en proveedores y 152 en implementadores, con entidades que firman las dos secciones. Es voluntario, y la Comisión Europea advierte de que adherirse «no constituye una evidencia concluyente del cumplimiento».

Leer más: Comisión Europea — respaldo al Código de Prácticas sobre Transparencia ↗

Las críticas tienen nombre y el ruido comercial tiene literal

La objeción de principio la firmó el 16 de agosto de 2026 John Gruber, que escribe y produce él solo Daring Fireball, el blog de tecnología que publica desde 2002: «La idea de que algo que no sean mis necesidades influya en la generación de un texto para mí es descaradamente ofensiva». Vale como opinión, no como descripción técnica. La práctica es de Mark A. Bassett, de la Charles Sturt University australiana, dos días después en The Conversation, el medio académico sin ánimo de lucro: fiarse de la marca para cazar copias da una falsa sensación de seguridad, y su ausencia no garantiza que no se haya usado IA.

Alrededor del anuncio se venden herramientas que prometen quitar los «caracteres ocultos» de Claude. Anthropic dice literalmente que no se añade nada al texto y que no hay caracteres ocultos, y sin su clave la marca no se puede comprobar; lo desmienten hasta páginas del propio negocio. El interés comercial es verificable; quién está detrás, no consta.

También se ha informado de bajas de suscripción: Business Insider publicó el 14 de agosto que decenas de personas dijeron en X haber cancelado. Nadie ha dado cifras y Anthropic responde que no ve ningún repunte. Ese día no existía aún ningún modelo de Claude con marca: fue una reacción al anuncio, no al producto.

Conclusión

El sello cumple una obligación legal real y resuelve menos de lo que promete: es fácil de borrar para quien quiera ocultar que usó la máquina, y casi imposible de rebatir para quien nunca la usó. El 2 de diciembre la obligación alcanzará al resto del mercado, y esa prueba pública seguirá sin existir.

Fuentes primarias

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Recibe el resumen diario de IA

    Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

    Frecuencia:

    ← Volver al blog