Días después de que Anthropic comenzara a implementar marcas de agua invisibles en los resultados de texto e imágenes de Claude, la función está generando exactamente el tipo de fricción que predijeron los críticos: a los usuarios les preocupaba que las marcas los expusieran por usar IA en el trabajo o en clase, los desarrolladores documentan cómo se comporta la marca de agua dentro de flujos de trabajo de codificación reales y un mercado pequeño pero visible de herramientas que prometen eliminarla.
Anthropic dice que el cambio alinea a Claude con la Ley de IA de la Unión Europea, cuyas reglas de transparencia se hicieron aplicables para los nuevos modelos después del 2 de agosto de 2026. El artículo 50 de la ley requiere que los proveedores de sistemas de IA hagan que la producción generada por máquinas sea "detectable como generada artificialmente". Anthropic confirmó que todos los modelos nuevos ofrecidos a nivel mundial, no solo en la UE, marcarán el contenido generado por IA "desde el primer día", con un período de gracia hasta diciembre de 2026 para actualizar los modelos lanzados anteriormente. Para más contexto sobre esta historia, consulta nuestra cobertura de la industria de IA.
Las marcas mismas son invisibles. Las salidas de texto "llevan marcas de agua incrustadas", mientras que los archivos generados incluyen metadatos de procedencia firmados digitalmente cuando el formato lo admite, según un artículo de soporte de Anthropic. Los modelos anteriores de Claude también se actualizarán para marcar texto, lo que significa que toda la flota eventualmente estampará su producción.
La marca de agua cubre el texto editado, no solo el texto generado
El detalle que convirtió la curiosidad técnica en una reacción violenta fue revelado por Ars Technica el 13 de agosto: la marca de agua se aplica al contenido que Claude procesa, no solo al contenido que genera desde cero. Ars caracterizó el enfoque como "atacarlo desde la órbita", porque Anthropic marca todo el contenido procesado cuando es compatible, aunque la propia guía de la UE no lo requiere cuando un sistema de inteligencia artificial realiza "una función de asistencia para la edición estándar" (el ejemplo de la regulación es la corrección gramatical) o cuando no "altera sustancialmente" el texto de un usuario.
Esa distinción es importante porque una marca de agua aplicada a nivel de modelo no puede diferenciar la generación mayorista de una corrección de coma. Ashley Belanger, de Ars Technica, señaló que Claude puede terminar estampando exactamente el tipo de escritura humana ligeramente retocada que la ley fue escrita para dejar en paz. En la práctica, la marca señala cualquier cosa que Claude procesó, incluso un documento que un humano escribió y solo le pidió a Claude que lo puliera.
Los usuarios temen ser atrapados en el trabajo y la escuela
La reacción de los usuarios no se hizo esperar. TechCrunch informó el 13 de agosto que algunos usuarios de Claude "están enojados porque las nuevas marcas de agua de Anthropic los pillarán usándolo en sus trabajos y clases". Los empleados que silenciosamente confían en Claude para redactar correos electrónicos, informes o presentaciones de diapositivas (y los estudiantes que lo usan en sus tareas) ahora enfrentan la posibilidad de que un jefe o instructor pueda verificar la participación de la IA con una herramienta de detección.
Ars Technica enmarcó la dinámica como una "Letra Escarlata": una insignia invisible del uso de la IA que el lector no puede ver pero que las instituciones pronto podrán ver. Debido a que la marca de agua viaja con el texto a través de copiar y pegar y cambios de formato, la defensa habitual de "acabo de editarlo un poco" ya no deja huellas dactilares de la IA.
Ya está surgiendo un mercado de mudanzas
Donde hay una marca de agua, sigue una industria de eliminación. SC Media informó que ya está surgiendo un mercado para herramientas de eliminación de marcas de agua con IA en los días posteriores a la actualización de Claude. Decrypt documentó que los desarrolladores están intentando activamente romper el esquema de marcado, investigando cómo se comporta al parafrasear, traducir y reformatear.
Las primeras pruebas sugieren que la marca de agua es resistente al manejo casual, pero tiene fugas en condiciones profesionales. La cobertura de New Stack concluyó que la marca "sobrevive al copiar y pegar, pero no al flujo de trabajo de desarrollo real", lo que significa que los desarrolladores de software que reelaboran sustancialmente el código sugerido por la IA como parte de la ingeniería normal pueden borrar la marca sin siquiera tener la intención de hacerlo.
Cómo funciona realmente la marca
Una explicación visual ampliamente compartida publicada en declaude.org desglosa el mecanismo. El texto no tiene píxeles para ocultar datos y ningún metadato sobrevive al copiar y pegar, por lo que la marca de agua vive en "las opciones entre palabras". Mientras un modelo escribe, selecciona repetidamente entre varias palabras siguientes igualmente plausibles; una clave criptográfica secreta sesga silenciosamente esas selecciones hacia un patrón que sólo el poseedor de la clave puede detectar.
La técnica se remonta a la investigación de Kirchenbauer et al. a partir de 2023, que dividió las palabras candidatas en listas "verdes" y "rojas" e inclinó a la generación hacia los tokens verdes. SynthID de Google llega a un destino similar a través de una ruta más sutil, y Google ha puesto una marca de agua en el texto de la aplicación y la experiencia web Gemini desde 2024; su API ha sido una excepción documentada. A partir de agosto de 2026, los nuevos modelos Claude marcarán texto a nivel de modelo, y los modelos anteriores seguirán.
Los escépticos dicen que la eliminación sigue siendo trivial
No todo el mundo está convencido de que la carrera armamentista favorezca a Anthropic. En un ensayo de amplia circulación, el ingeniero Sean Goedecke argumentó que las marcas de agua de texto "siempre será trivial eliminarlas" porque el texto es un medio extremadamente comprimido: cualquier cambio lo suficientemente fuerte como para sobrevivir a una eliminación determinada es un cambio que un lector humano notaría. Las herramientas de paráfrasis, los viajes de ida y vuelta de la traducción y la reformulación deliberada amenazan con borrar los patrones estadísticos sin degradar el significado.
El debate se desarrolla en las comunidades de desarrolladores: dos explicadores separados de las marcas de agua se ubicaron entre las historias más discutidas en Hacker News esta semana, generando cientos de puntos de interacción entre ellos.
¿Qué pasa después?
Anthropic ha dicho que eventualmente compartirá detalles sobre cómo detectar las marcas (soporte técnico que requiere la regulación de la UE), pero hasta que se envíe una herramienta de detección pública, las partes externas no pueden verificar qué tan exhaustiva es realmente la marca. La compañía también reconoció que las marcas de agua no funcionarán en "algunas plataformas o funciones" que no las admitan.
Mientras los modelos más antiguos enfrentan una fecha límite de cumplimiento de diciembre de 2026 y los laboratorios rivales observan si los usuarios castigan a Anthropic por su transparencia, los próximos meses probarán una propuesta que la industria ha evitado durante años: si los proveedores de IA pueden hacer que su producción sea rastreable sin que sea tóxica para las personas que dependen de ella.
---
Mantente al Día con la IALas últimas noticias, análisis y avances de inteligencia artificial, en un solo lugar.
Leer más noticias de IA →