EDICIÓN Nº 022 · Martes 6 oct 2026
Tecnología

ChatGPT empieza a marcar sus textos en Europa con una firma invisible

OpenAI activa en la UE textGrain, una marca de agua estadística escondida en la elección de palabras. Así funciona, esto es lo que detecta y aquí es donde falla.

Redacción2026-10-06inteligencia artificial · marcas de agua · ChatGPT · Unión Europea · privacidad
Linen Bank A4 backlit watermarks
Foto: Olli Niemitalo · CC0 · Wikimedia Commons · realzada con IA

Ya no hace falta pegar una etiqueta que diga «esto lo ha escrito una IA». Desde este mes, el texto que generan ChatGPT y Codex para usuarios de la Unión Europea lleva una marca de agua invisible. Se llama textGrain y no se ve en pantalla. Tampoco va en caracteres ocultos ni en espacios raros: la marca está en las propias palabras que elige el modelo.

OpenAI lo presenta como su forma de cumplir el artículo 50 del Reglamento Europeo de Inteligencia Artificial. Ese artículo, aplicable desde el 2 de agosto de 2026, obliga a quien ofrece IA generativa en la UE a marcar el contenido sintético de forma que una máquina pueda reconocerlo.

Cómo se esconde una firma en una frase

Un modelo de lenguaje escribe palabra a palabra o, para ser exactos, token a token. En cada paso calcula qué candidatos encajan y con qué probabilidad. Casi siempre hay varias opciones casi igual de buenas: «empezar» o «comenzar», «además» o «también».

Hands are seen typing on a laptop keyboard
Foto: Shixart1985 · CC BY 2.0 · Wikimedia Commons

textGrain aprovecha ese margen. Con una clave secreta, inclina un poco la balanza hacia ciertos grupos de tokens. En una frase suelta no se nota nada, porque la diferencia es mínima. Pero en un texto de varios cientos de palabras esas pequeñas preferencias se acumulan y forman un patrón estadístico. Un detector que tenga la misma clave puede reconstruir esos grupos y comprobar si el texto los favorece más de lo que se esperaría por azar.

Según OpenAI, la señal aguanta el copiar y pegar y no empeora de forma apreciable la calidad de las respuestas. La compañía también asegura que la marca «no identifica al usuario»: dice que el texto viene de su modelo, no quién lo pidió. Según recoge The Verge, OpenAI afirma que su sistema iguala o supera a otras propuestas como SynthID, la técnica de Google DeepMind para texto. SynthID es también la base de la marca de agua que Anthropic anunció en agosto.

Qué cambia para el usuario

  • En la UE: el despliegue en ChatGPT y Codex empezó el 5 de octubre y se completará en las próximas semanas. Para los textos que entran en el sistema, la marca no se podrá desactivar.
  • Fuera de la UE: por ahora no hay marca en ChatGPT. Desde el 5 de octubre, los desarrolladores de cualquier país pueden activarla en la API, pero viene desactivada por defecto.
  • Al leer: nada cambia a simple vista. No hay iconos ni avisos. El texto parece el de siempre.

¿Quién puede comprobar si un texto está marcado? De momento, casi nadie. Según el informe técnico, el detector solo está disponible para investigadores y organizaciones especializadas aprobadas, que tienen que solicitarlo aparte. No hay fecha para una herramienta pública.

Hands are typing on a laptop keyboard while a clock rests next to the device
Foto: Shixart1985 · CC BY 2.0 · Wikimedia Commons

La letra pequeña: dónde falla la marca

El informe técnico que acompaña al anuncio, resumido por medios especializados, da cifras que conviene leer con calma:

Children's learner typing on the laptop keyboard closeup
Foto: Shixart1985 · CC BY 2.0 · Wikimedia Commons
  • La longitud importa. En inglés, con textos de unos 400 tokens, la detección ronda el 95 % con una tasa de falsos positivos del 1 %. Con 200 tokens baja a cerca del 80 %. Por debajo de ese tamaño, la propia compañía considera la detección poco fiable.
  • El idioma también. En español la tasa medida cae al 69 % y en rumano, al 42,2 %. Para una herramienta pensada para los 24 idiomas oficiales de la UE, la diferencia es grande.
  • Retocar el texto la borra. Si se cambia un 10 % de las palabras por sinónimos, la detección baja al 66 %. Con un 25 % de cambios se queda en el 17 %. Las traducciones y las reescrituras a fondo también debilitan la señal.
  • Las respuestas casi cerradas apenas se marcan. En matemáticas o en contenido simbólico, donde la respuesta correcta es casi única, el modelo no tiene margen para elegir y la detección cae mucho. Según el informe, el código en sí no entra en la obligación de marcado.
  • No mide autoría. El sistema indica si hay rastro del modelo, pero no qué parte del texto escribió una persona y qué parte la IA.

Dicho de otra forma, la marca sirve para detectar textos largos generados y apenas tocados. Contra alguien que quiera ocultar el origen, protege poco: basta con reescribir. Y cuando el texto está en español, falla en casi uno de cada tres casos incluso sin editar.

Por qué importa

Es la primera vez que un asistente de uso masivo marca sus textos por defecto, y el resto del sector va en la misma dirección. En Europa no es una opción comercial, es una obligación legal. Para el lector, la marca puede ayudar a plataformas, investigadores y verificadores a seguir la pista del contenido automático a gran escala. Pero los propios números de OpenAI dejan claro que no es un detector infalible. Un resultado negativo no demuestra que un texto sea humano. Uno positivo dice que viene de una IA, no si es verdad o mentira. Leer con criterio sigue siendo cosa nuestra.

Texto generado con inteligencia artificial a partir de las fuentes citadas, sin revisión humana individual (Reglamento UE 2024/1689, art. 50). Las fotos llevan su crédito y licencia; las marcadas como realzadas se han retocado con IA sin alterar su contenido.

Comentarios