OpenAI activa textGrain: marca de agua invisible en ChatGPT solo para la UE

OpenAI comenzará a marcar de forma automática los textos generados por ChatGPT y Codex en la Unión Europea. La compañía presentó el 5 de octubre de 2026 su sistema de marca de agua invisible, bautizado como textGrain, que llegará a los usuarios comunitarios de todos los planes a lo largo de las próximas semanas, sin fecha concreta confirmada. Fuera de la UE, la función existirá pero permanecerá desactivada por defecto. El motivo es legal: el artículo 50 del Reglamento Europeo de Inteligencia Artificial exige desde el 2 de agosto de 2026 que las salidas de los sistemas generativos sean detectables por máquinas.

  • Alcance limitado: el marcado es obligatorio y automático solo para ChatGPT y Codex en la UE, mientras que en la API global es opcional y está apagado por defecto.
  • Método estadístico: textGrain no inserta caracteres ocultos, sino que sesga la elección de palabras mediante una clave secreta que solo un detector autorizado puede leer.
  • Fragilidad demostrada: según las propias pruebas de OpenAI, sustituir una cuarta parte de las palabras por sinónimos hunde la detección del 92% al 17%.
  • Detector cerrado: el acceso a la herramienta de verificación está restringido a investigadores y organizaciones expertas aprobadas caso por caso.

Cómo funciona textGrain y por qué un sinónimo lo desarma

El sistema opera sobre la elección de palabras. Cada vez que el modelo selecciona su siguiente token, una clave secreta lo empuja hacia unas opciones frente a otras, generando una señal estadística invisible para el lector humano y sin coste aparente de calidad. No hay caracteres ocultos que puedan borrarse: el patrón vive en el texto mismo y solo se revela ante quien posee la clave y un detector especializado.

Esa arquitectura tiene un punto débil evidente, y OpenAI lo documenta con sus propias mediciones, calculadas asumiendo una tasa de falsos positivos del 1% sobre texto humano. En pasajes de 400 tokens sin editar, el detector identifica la marca en torno al 95% de los casos; con 200 tokens, la cifra cae al 80%. Si se reemplaza el 10% de las palabras por sinónimos, la detección baja al 66%; si la sustitución alcanza el 25%, se desploma hasta el 17%. En respuestas matemáticas el rendimiento es «sustancialmente inferior», porque hay menos libertad para escoger términos. En otras lenguas de la UE, con enunciados traducidos, el rango va del 42,2% en rumano al 69,0% en español. Todas estas cifras proceden de OpenAI, medidas sobre sus propios modelos, y ningún laboratorio externo las ha reproducido todavía.

Sin coste en benchmarks, pero con puertas cerradas

La compañía publicó ocho comparativas emparejadas del modelo Astra en razonamiento máximo, con y sin marca de agua. Las diferencias van en ambas direcciones: GPQA Diamond pasó del 94,44% al 93,94% y DeepSWE v1.1 del 72,80% al 71,68%, mientras que Terminal-Bench Science 0.1 subió del 56,90% al 60,00% y el índice de inteligencia de Artificial Analysis avanzó de 49,57 a 49,76 puntos. OpenAI interpreta esa dispersión como prueba de que no existen diferencias de rendimiento relevantes y asegura que textGrain «igualó o superó» a otros enfoques probados, entre ellos SynthID.

Un rendimiento sólido en condiciones ideales no garantiza una detección fiable en el uso cotidiano, advierte OpenAI.

El detector no es público. Las solicitudes se abrieron el 5 de octubre y el acceso se concede caso por caso conforme al Código de Prácticas europeo, con el argumento de evitar falsos positivos y marcas no detectadas. Entre los primeros aprobados figurarían Cornell, ETH Zúrich y el instituto eslovaco KInIT. La API permite activar la marca a clientes de todo el mundo para «modelos selectos» que no se han especificado. Hay una liberación en código abierto prometida, pero sin fecha. La verificación de imagen y audio no cambia y sigue abierta a cualquiera.

Lo que la marca no puede demostrar

OpenAI enumera cinco límites que conviene tener presentes: un resultado positivo no mide la contribución humana, no establece propiedad ni responsabilidad, no identifica al usuario y no verifica la exactitud del contenido. El quinto matiz es el más incómodo: la ausencia de marca no prueba autoría humana, ya que el texto puede ser demasiado corto, haber sido editado o traducido, o proceder de un modelo no soportado. Anthropic, en cambio, marca el texto de Claude en todas las regiones desde el 2 de agosto. Las sanciones por incumplimiento alcanzan los 15 millones de euros o el 3% de la facturación mundial, y los sistemas ya comercializados antes de esa fecha disponen de un periodo de gracia hasta el 2 de diciembre de 2026.

El lanzamiento deja una fotografía incómoda: una obligación regulatoria que se apoya en una tecnología que la propia empresa reconoce frágil ante una simple pasada por el diccionario de sinónimos. Para los equipos editoriales y de comunicación, la marca de agua no sustituye la obligación de divulgar el uso de IA ni de designar a alguien con responsabilidad editorial sobre el contenido publicado. Para quienes construyen productos sobre la API, la advertencia es distinta: si publican su propio sistema generativo, la obligación del artículo 50 puede recaer sobre ellos y la marca seguirá apagada salvo que la activen expresamente. El marcado de texto llega, pues, antes como trámite de cumplimiento normativo que como herramienta fiable de atribución, y su utilidad real dependerá de si la liberación en código abierto y el detector abierto permiten algún día que terceros independientes comprueben lo que hoy solo OpenAI puede afirmar.

Fuentes y referencias