Copiar y pegar un texto generado por Claude podría dejar de ocultar completamente su origen. Anthropic anunció un nuevo sistema de marcado diseñado para incorporar una señal imperceptible directamente dentro de los textos producidos por sus modelos compatibles.
La compañía explica que esta marca de agua no debería modificar el significado, la calidad ni la legibilidad de las respuestas. Al estar integrada en el propio texto, puede mantenerse cuando el contenido se copia y pega en otras aplicaciones e incluso sobrevivir a determinadas modificaciones.
El sistema se implementará a nivel del modelo, por lo que estará presente independientemente de dónde se utilice Claude. Esto incluye servicios como Claude, Claude Code, Claude Cowork, Claude Tag y la API, además del acceso mediante plataformas de terceros como AWS, Google Cloud y Microsoft Foundry cuando el modelo utilizado sea compatible.
Los archivos también tendrán su propio mecanismo de identificación. Para formatos compatibles como PNG, JPG o SVG, Anthropic utilizará metadatos de procedencia firmados basados en el estándar C2PA, permitiendo comprobar si determinados archivos fueron procesados por Claude.
La medida está relacionada con las nuevas obligaciones de transparencia de la Ley de Inteligencia Artificial de la Unión Europea. Los modelos de Claude lanzados en la UE a partir del 2 de agosto de 2026 deberán incorporar estas marcas desde su lanzamiento, mientras que Anthropic continúa trabajando para añadir soporte a modelos anteriores.
Sin embargo, la tecnología no es infalible. Anthropic reconoce que una edición profunda, una paráfrasis extensa, una traducción o la combinación del contenido con otros textos puede hacer que la marca deje de ser detectable. Los fragmentos demasiado cortos también pueden ofrecer una señal insuficiente.
Además, encontrar una marca no demuestra necesariamente que Claude haya escrito todo el contenido desde cero. Un documento inicialmente creado por una persona podría terminar marcado simplemente después de ser corregido, traducido, resumido o procesado por Claude.
Anthropic también prepara herramientas que permitirán a usuarios y terceros comprobar estas señales, aunque todavía no ha publicado todos los detalles técnicos sobre el funcionamiento de su detector.
La decisión abre una nueva etapa en la identificación de contenido generado por inteligencia artificial: en el futuro, detectar el uso de una IA podría depender menos de analizar cómo está escrito un texto y más de encontrar una señal colocada directamente por el propio modelo.