Diario TI

OpenAI habilita marcas de agua opcionales para texto en su API

El marcado llegará también a respuestas elegibles de ChatGPT y Codex en la UE. La detección tiene limitaciones.

OpenAI anunció el 5 de octubre de 2026 el marcado opcional de texto para determinados modelos de su API, disponible globalmente y desactivado por defecto. También prevé incorporarlo durante las próximas semanas a respuestas elegibles de ChatGPT y Codex en la Unión Europea, según su comunicado oficial.

Cómo funciona textGrain

La tecnología se denomina textGrain. Su informe técnico explica que modifica el muestreo de tokens —palabras o fragmentos de palabras— mediante valores seudoaleatorios derivados de una clave secreta. Estas elecciones dejan una señal estadística que un detector puede buscar posteriormente.

El método controla cuánta aleatoriedad sacrifica la generación para introducir esa señal. El detector necesita el texto y la clave correspondiente; no requiere conocer las instrucciones originales ni acceder a la conversación.

La marca forma parte de las elecciones de palabras: no añade caracteres ocultos, espacios invisibles ni puntuación especial. Según el centro de ayuda de OpenAI, conservar la redacción permite conservar la señal esperada, aunque no garantiza su detección.

Resultados sujetos a la longitud y la edición

En las evaluaciones divulgadas por OpenAI, con una tasa objetivo de falsos positivos del 1 %, la detección alcanzó aproximadamente el 80 % en pasajes de 200 tokens y el 95 % en los de 400 tokens sobre psicología. El rendimiento fue inferior en matemáticas.

En otra prueba con textos en inglés de 400 tokens, sustituir por sinónimos el 10 % de las palabras redujo la detección del 92 % al 66 %. Con una sustitución del 25 %, cayó al 17 %.

Estas cifras describen ensayos concretos de la empresa. No deben interpretarse como una precisión universal: una tasa objetivo de falsos positivos del 1 % tampoco significa que cada resultado positivo tenga un 99 % de probabilidad de ser correcto.

Qué exige la normativa europea

Las directrices de la Comisión Europea sitúan la aplicación del artículo 50 desde el 2 de agosto de 2026 y distinguen las obligaciones de los proveedores de las correspondientes a quienes utilizan los sistemas.

El artículo 50.2 exige marcado legible por máquinas y detección del origen artificial. La eficacia, interoperabilidad, robustez y fiabilidad de las soluciones deben asegurarse en la medida técnicamente viable. Contempla excepciones para funciones de edición estándar o que no alteren sustancialmente los datos de entrada o su significado.

Para publicaciones de texto sobre asuntos de interés público, el artículo 50.4 establece una obligación de divulgar la intervención de IA. Prevé una excepción cuando existe revisión humana o control editorial y una persona física o jurídica asume la responsabilidad editorial. Esta excepción es distinta de las reglas de marcado técnico aplicables al proveedor.

Una señal de procedencia con alcance limitado

Como explica OpenAI en su documentación de procedencia, detectar una marca no determina la autoría, la propiedad, la responsabilidad legal ni cuánto aportó una persona. Tampoco certifica la veracidad del contenido. La ausencia de señal no demuestra origen humano: una traducción o una reescritura pueden dificultar la detección.

Activar el marcado en la API tampoco concede acceso automático al detector de texto. Su uso está restringido inicialmente a organizaciones de investigación aprobadas. Las señales técnicas no sustituyen los avisos visibles que puedan exigirse según el uso del contenido.

Fuentes

📬 Newsletter gratuito

Últimos artículos