OpenAI añadirá marcas de agua invisibles al texto de ChatGPT y Codex en la Unión Europea y abrirá su detector a investigadores acreditados. La compañía admite sin rodeos que la técnica detecta mucho mejor los textos largos que las respuestas cortas.
Por qué OpenAI marca el texto ahora
El Reglamento Europeo de Inteligencia Artificial obliga a los proveedores de IA generativa a que el texto generado pueda identificarse de forma legible por máquina. OpenAI publicó su enfoque el 5 de octubre para cumplir esa norma, y el calendario va atado al artículo 50, la disposición de transparencia que se aplica desde el 2 de agosto de 2026, con un plazo hasta el 2 de diciembre de 2026 para los sistemas que ya están en el mercado.
El plan tiene tres partes. Los clientes de la API en todo el mundo pueden activar las marcas de agua para determinados modelos desde ahora, y vienen desactivadas por defecto. En las próximas semanas, OpenAI añadirá una marca invisible al texto elegible de ChatGPT y Codex en la Unión Europea. Y la compañía abre las solicitudes para su detector de marcas, limitado al principio a investigadores y organizaciones expertas aprobadas.
Ese último detalle condiciona la utilidad real del sistema. Los usuarios corrientes y la mayoría de las plataformas no podrán comprobar un texto por su cuenta, al menos de momento. La marca actúa en la salida del modelo, pero la verificación queda detrás de una puerta mientras OpenAI evalúa su fiabilidad.
Cómo textGrain incrusta la marca en el texto de ChatGPT
OpenAI llama a su método textGrain. Añade una señal estadística invisible a las palabras que elige el modelo. Para el lector, la frase no cambia en nada. El detector, en cambio, conoce el patrón y comprueba si el texto lo lleva.
La verificación de audio e imagen ya funciona con herramientas públicas como la página openai.com/verify y la API de procedencia de contenido, y esas siguen abiertas a cualquiera. El texto es un problema más difícil porque no hay un archivo al que pegarle una firma.
Dónde falla la marca de agua
OpenAI es inusualmente franca sobre los límites. En sus propias evaluaciones, con una tasa de falsos positivos del 1%, el detector encontró la marca en alrededor del 80% de fragmentos de 200 tokens y en cerca del 95% de fragmentos de 400 tokens en contenidos como los de psicología. La detección caía en picado en matemáticas, donde hay menos libertad para escoger palabras.
Editar debilita la señal muy rápido. En fragmentos de 400 tokens, sustituir el 10% de las palabras por sinónimos bajó la detección del 92% aproximado al 66%. Sustituir el 25% la dejó en el 17%.
Escenario | Tasa de detección |
|---|---|
Fragmento de 200 tokens | cerca del 80% |
Fragmento de 400 tokens | cerca del 95% |
400 tokens, 10% de palabras cambiadas | cerca del 66% |
400 tokens, 25% de palabras cambiadas | cerca del 17% |
La conclusión para quien espera cazar texto de IA: las respuestas cortas, la escritura llena de fórmulas y los párrafos apenas reescritos son justo los casos donde la marca da menos señal. OpenAI dice que probó textGrain contra otros métodos, incluido SynthID for text de Google, y que igualó o superó a esos sistemas en condiciones ideales, a la vez que avisa de que un buen resultado en laboratorio no garantiza una detección fiable en el día a día.
Qué significa el detector para investigadores y lectores
El detector importa porque una marca solo sirve si alguien puede leer la señal. OpenAI limita el acceso temprano a investigadores y organizaciones expertas acreditadas, que ayudarán a probar la fiabilidad y a definir usos responsables.
Hay un ángulo de privacidad que conviene nombrar. La procedencia puede confirmar que alguien se apoyó en un asistente de IA, incluso en situaciones en las que ese uso es lícito, privado o comercialmente sensible. Tampoco dice si el texto es verdadero. Una persona puede escribir falsedades, y un modelo puede redactar frases exactas. La señal solo apunta a de dónde viene el texto.
¿Basta la marca de agua para cumplir el Reglamento de IA?
OpenAI presenta la marca de texto como una tecnología temprana con límites reales, y su despliegue por fases refleja esa idea. Que la API venga desactivada por defecto y que el detector tenga acceso restringido son precauciones, no descuidos.
Si desarrollas sobre la API, la marca es un interruptor que puedes activar, y permanece apagada salvo que lo hagas. Si eres usuario de ChatGPT en la UE, cuenta con que la marca invisible llegará en las próximas semanas lo notes o no. Para el resto, la pregunta práctica es si una señal que se desvanece con una edición ligera puede soportar el peso que le pide la ley. OpenAI asegura que tiene previsto liberar la tecnología como código abierto para que otros construyan sobre ella, lo que puede ayudar a responder esa duda con el tiempo.






