Diario TI

Los nuevos modelos de Claude incorporarán una marca invisible en el texto

La medida responde a las obligaciones de transparencia de la Ley de Inteligencia Artificial de la Unión Europea y se extenderá mundialmente en los modelos compatibles.

Anthropic incorporará marcas legibles por máquina (watermarks) en el contenido producido por los nuevos modelos Claude. La medida alcanza a los modelos lanzados en la Unión Europea a partir del 2 de agosto de 2026 y se aplicará mundialmente en los lugares donde esos modelos estén disponibles.

El anuncio no significa que todas las respuestas generadas actualmente por Claude ya lleven esta señal. Anthropic indicó que los modelos compatibles lanzados desde esa fecha incluirán el sistema desde su presentación, mientras trabaja para añadirlo a modelos anteriores durante un periodo de transición.

Una señal integrada en las palabras

Para el texto, Anthropic utilizará lo que describe como una marca imperceptible incorporada durante la generación. Según la empresa, la señal no será visible para el lector ni cambiará el significado o la legibilidad de la respuesta.

Al estar integrada en el texto y no depender exclusivamente de los metadatos de un documento, la marca podrá conservarse cuando el contenido se copie y pegue en otra aplicación. Anthropic afirma que también podría sobrevivir a ciertas modificaciones.

La marca se aplicará en el nivel del modelo. Por esa razón, estará presente en el texto producido desde los servicios compatibles, incluidos Claude, Claude Code, Claude Cowork, Claude Tag y la plataforma para desarrolladores. También se contempla su aplicación cuando los modelos sean utilizados mediante Amazon Web Services, Google Cloud o Microsoft Foundry.

Cómo puede marcarse un texto

Anthropic todavía no ha explicado públicamente el mecanismo técnico concreto utilizado por Claude. La empresa adelantó que publicará documentación adicional y ofrecerá medios para que usuarios y terceros puedan detectar sus marcas.

Uno de los métodos estudiados para marcar la salida de los modelos de lenguaje consiste en modificar de manera controlada las probabilidades con las que el sistema selecciona sus siguientes palabras o fragmentos. Esto introduce un patrón estadístico que resulta natural para el lector, pero que puede ser identificado mediante un detector que conozca las reglas empleadas.

La investigación académica ha demostrado que este tipo de técnica puede detectar fragmentos generados por un modelo sin añadir caracteres visibles. Sin embargo, su eficacia depende de factores como la longitud del texto, el grado de edición y la cantidad de alternativas que tenía el modelo al redactar cada pasaje.

La detección no prueba la autoría

Anthropic advierte que encontrar una marca solo indica que el contenido pudo haber sido procesado por Claude. No demuestra que el modelo sea el autor de las ideas ni que haya redactado íntegramente el documento.

Un texto escrito por una persona podría recibir la marca después de pasar por Claude para ser corregido, traducido, resumido o reformulado. También podría combinarse una respuesta del modelo con material procedente de otras fuentes.

La ausencia de una marca tampoco permite concluir que el contenido fue escrito por una persona. La señal podría no aparecer si se utilizó un modelo anterior, si el pasaje es demasiado corto o si el texto fue profundamente editado, traducido, parafraseado o mezclado con otros materiales.

Estas limitaciones reducen el alcance de la medida para detectar novelas, artículos o trabajos académicos elaborados con inteligencia artificial. El sistema podría facilitar la identificación de bloques extensos copiados con pocos cambios, pero no constituye un método infalible para determinar la autoría de una obra.

Metadatos firmados para imágenes y archivos

Anthropic empleará un método diferente en archivos compatibles, como imágenes PNG y JPG o gráficos SVG. En estos casos añadirá metadatos de procedencia firmados digitalmente y basados en el estándar C2PA.

La presencia de estos datos indicará que el archivo fue procesado por Claude y permitirá comprobar si fue alterado posteriormente. La empresa reconoce que esta función no estará necesariamente disponible en todos los tipos de archivo, productos o plataformas asociadas.

Una respuesta a la regulación europea

La iniciativa forma parte de los compromisos asumidos por Anthropic en el Código de Prácticas sobre Transparencia del Contenido Generado por Inteligencia Artificial de la Unión Europea.

El artículo 50 de la Ley de Inteligencia Artificial exige que los proveedores de sistemas capaces de generar texto, audio, imágenes o video incorporen mecanismos legibles por máquina que permitan detectar el origen artificial del contenido, siempre que resulte técnicamente viable.

Estas obligaciones comenzaron a aplicarse el 2 de agosto de 2026. La adhesión al código de prácticas es voluntaria, pero las exigencias legales de transparencia son obligatorias para los sistemas comprendidos por la normativa.

Quedan por conocer datos esenciales sobre la implementación de Anthropic, incluidos el funcionamiento del detector, las tasas de falsos positivos y negativos, el comportamiento en distintos idiomas y la resistencia de la señal frente a ediciones sucesivas. Hasta que esa información esté disponible, la marca debe considerarse un indicio de procedencia y no una prueba definitiva de autoría o uso indebido.

Fuentes

Ilustración creada por IA.

📬 Newsletter gratuito

Últimos artículos