Noticias

ChatGPT pondrá marca de agua invisible a sus textos en la UE; en LATAM, por ahora, no

Ilustración con una metáfora visual (la marca real no se ve con ninguna luz): sobre una losa de pizarra gris, una resma de papel impreso con el canto de las hojas a la vista; el haz violeta de una linterna ultravioleta, apoyada adelante, revela en la hoja de arriba algunas palabras que brillan como tinta invisible. Abajo, en una franja negra, el logo de OpenAI, el texto «OpenAI · ChatGPT en la Unión Europea» y el titular «Una firma que no se ve».

OpenAI anunció este 5 de octubre que, en las próximas semanas, el texto que generen ChatGPT y Codex para los usuarios elegibles de la Unión Europea, en todos los planes, va a llevar una marca de agua invisible. Esta marca de agua de ChatGPT no es un sello ni una leyenda: es un patrón escondido en la elección de las palabras, que el lector no ve y que solo puede encontrar un detector con la clave. La empresa lo hace para cumplir con la ley de inteligencia artificial europea, que, según OpenAI, exige que el texto generado se pueda identificar como tal de forma legible por máquinas.

Qué cambia si usás ChatGPT en América Latina: por ahora, nada. OpenAI escribió que la marca en ChatGPT llega «solo en la UE» y que no la va a activar como opción por defecto en todo el mundo al lanzamiento. Lo que sí arrancó hoy para todos los países es otra cosa: quienes usan la API de OpenAI, como las empresas que la conectan a sus propias apps, pueden activar la marca en algunos modelos, si quieren; viene apagada.

Y una aclaración que le sirve a cualquiera que corrija textos: el detector de OpenAI no es público. Por ahora solo pueden pedir acceso investigadores y organizaciones especializadas, y la empresa los aprueba caso por caso. O sea que, salvo los investigadores que OpenAI apruebe, nadie (ni un docente que corrige, ni un cliente, ni un jefe) tiene hoy una herramienta oficial abierta al público para comprobar si un texto lleva la firma de ChatGPT. Si alguien te dice que «pasó tu texto por el detector de OpenAI», no fue por uno abierto al público.

Cómo funciona la marca de agua de ChatGPT, sin el folleto

La tecnología se llama textGrain y es de OpenAI. Según la ayuda oficial de la empresa, cuando el modelo escribe tiene, a cada paso, varias palabras posibles con distinta probabilidad. La marca ajusta en secreto cómo elige entre ellas, siguiendo una clave, sin cambiar el promedio de esas elecciones. A lo largo de un pasaje, esas elecciones forman un patrón que un detector con la misma clave puede buscar.

  • No agrega nada al texto. OpenAI dice que no inserta caracteres ocultos, espacios invisibles ni signos raros, y que copiar y pegar no suma material escondido. La firma está en las palabras mismas.
  • No se ve. Leído por una persona, un texto con marca y uno sin marca son iguales. No hay luz, filtro ni truco de editor que la muestre.
  • No empeora las respuestas, según las pruebas de la empresa: en los benchmarks con los que evalúa a Astra, su modelo más reciente, OpenAI no vio diferencias significativas con y sin marca. El impacto en la velocidad, dice, es despreciable.
Ilustración de tres sobres de papel madera sobre una tabla de roble, bajo el título «¿Dónde lleva marca el texto?». El primero, cerrado con lacre azul: «Unión Europea: ChatGPT y Codex, con marca, en las próximas semanas». El segundo, sin sello: «América Latina y el resto del mundo: ChatGPT, sin marca al lanzamiento». El tercero, con un sello de bronce al lado: «API, en todo el mundo: opcional, apagada salvo que la actives».
Ilustración de TCD. El alcance sale del anuncio de OpenAI del 5 de octubre de 2026; la marca en la Unión Europea es un plan para las próximas semanas, sin fecha exacta.

Qué tan bien se detecta (y qué la borra)

La parte más honesta del anuncio de OpenAI es la que admite los límites. La propia empresa dice que la marca de agua en texto y su detección son tecnologías tempranas con limitaciones importantes, y publicó sus propias mediciones. Las cifras se miden en tokens, que son pedazos de palabra: según la ayuda de OpenAI, 200 tokens son unas 150 palabras en inglés. Todas las cifras de esta tabla son de pruebas de OpenAI, con una tasa objetivo de falsos positivos del 1 %:

SituaciónDetecciónCondición de la prueba
Texto de 400 tokensCerca del 95 %Respuestas en inglés sobre temas como psicología.
Texto de 200 tokensCerca del 80 %Mismo tipo de contenido. Cuanto más corto, más difícil.
Matemática«Sustancialmente» menorHay menos formas de decir lo mismo. OpenAI no da la cifra en el anuncio.
Español69 %Otra prueba: 500 consignas en inglés traducidas a las 24 lenguas oficiales de la UE. El español fue el idioma con la tasa más alta; el rumano, el más bajo (42,2 %). No se compara con las filas de arriba: es otra base de textos.

El número de 200 tokens no es casual. El Código de Prácticas europeo sobre transparencia del contenido generado por IA, que OpenAI firmó, no exige la marca en respuestas de menos de 200 tokens ni en fragmentos de código, justamente porque ahí la detección no es confiable.

Y lo que más la debilita es editar. En otra prueba, también con pasajes de 400 tokens, reemplazar el 10 % de las palabras por sinónimos bajó la detección de cerca del 92 % al 66 %, y reemplazar el 25 % la dejó en el 17 %. La ayuda agrega que reescribir a fondo, parafrasear o traducir también la vuelven menos confiable. Una firma que no se ve, que no se puede chequear en público y que se gasta cambiando una de cada cuatro palabras: la tinta invisible del kit de espía de la infancia duraba más.

Ilustración de tres hojas de papel sobre un secante verde, cada vez más corregidas con lápiz rojo, bajo el título «¿Qué borra la marca?». Las etiquetas dicen: «Texto sin cambios: 92 %», «10 % de palabras cambiadas: 66 %» y «25 % de palabras cambiadas: 17 %». Una nota aclara que es la detección en pruebas de OpenAI con pasajes de 400 tokens en inglés y que los valores son aproximados.
Ilustración de TCD con cifras del anuncio de OpenAI del 5 de octubre de 2026: detección en pasajes de 400 tokens en inglés, antes y después de cambiar palabras por sinónimos.

Lo que la marca no dice

OpenAI dedica una sección entera a esto, y es la que conviene tener a mano si alguna vez te acusan de haber «escrito con ChatGPT». Según la empresa, encontrar la marca:

  • No mide cuánto aportó una persona. Puede indicar que un sistema de OpenAI generó o procesó parte de un pasaje, pero no cuánto criterio, edición o creatividad humana hay detrás.
  • No dice de quién es el texto, si su uso fue legal ni quién es responsable de él.
  • No identifica al usuario. No asocia el texto a una persona, una cuenta, una consigna ni una conversación. El detector solo informa si encuentra la marca, sin mostrar las consignas ni las conversaciones.
  • No verifica si lo que dice es cierto.

Y al revés: que no aparezca la marca no prueba que lo escribió una persona. El texto pudo ser demasiado corto, editado o traducido, haber salido de un modelo sin marca, ser anterior a la marca o venir de la herramienta de otra empresa.

Otra confusión que la ayuda de OpenAI aclara: los detectores de IA de terceros, como Pangram, que la empresa nombra como ejemplo, suelen usar clasificadores que analizan el texto ya escrito en busca de patrones, como la elección de palabras. Son otra técnica. La ley europea, dice OpenAI, pide específicamente una señal metida dentro del texto generado, que es lo que hace textGrain.

Quién puede usar el detector hoy

Desde hoy, investigadores y organizaciones especializadas aprobadas pueden pedir acceso al detector de texto, y OpenAI va a decidir caso por caso. La empresa dice que, por el riesgo de marcas que no se detectan y de falsos positivos, no lo hace público en el lanzamiento. Para estudiar la tecnología ya trabaja con un grupo chico de investigadores: John Thickstun, profesor asistente de Ciencias de la Computación en la Universidad Cornell; Martin Vechev, profesor de ETH Zúrich y director científico de INSAIT; e investigadores del Kempelen Institute of Intelligent Technologies (KInIT).

Con imágenes y audio la situación es distinta, y eso sí lo podés probar hoy. Las imágenes que generan ChatGPT, Codex y la API de OpenAI ya llevan dos señales, las Content Credentials del estándar C2PA y la marca de agua SynthID, y el audio lleva SynthID; en la API quedan afuera algunos modelos que OpenAI va a retirar pronto, como gpt-image-1. Para chequear un archivo, la herramienta pública es openai.com/verify: subís la imagen o el audio y te dice si encuentra señales asociadas a OpenAI. Sirve para lo que se puede verificar, no para todo: según la ayuda, SynthID está pensado para aguantar cambios comunes, pero un recorte fuerte o la compresión del archivo pueden volverlo indetectable, y una captura de pantalla o un cambio de formato pueden borrar las Content Credentials.

Si tu empresa usa la API de OpenAI

Este es el cambio que sí alcanza hoy a una PyME latinoamericana. Si tu negocio usa la API, por ejemplo en un chatbot de atención o en una herramienta interna, la marca está apagada salvo que la actives. Según la ayuda oficial, se enciende así:

  • Para toda la organización: Organization settings → Data controls → Text provenance.
  • Para un proyecto puntual: Project Settings → Text provenance.
  • En los dos casos, activás Allow text watermarking, elegís los modelos y guardás. La lista de modelos compatibles aparece en esos mismos ajustes; OpenAI dice que en las próximas semanas va a sumar todos sus modelos anteriores.

Tres cosas para saber antes de tocar ese interruptor: activarlo no te da acceso al detector, así que no vas a poder comprobar tus propios textos; no reemplaza las etiquetas visibles del tipo «generado con IA» que te puedan corresponder; y la propia OpenAI aclara que no puede asesorarte sobre tus obligaciones legales, que las tiene que evaluar tu equipo legal. Lo más probable es que le interese sobre todo a quien ofrece servicios con texto generado a usuarios de la Unión Europea. Si usás los modelos de OpenAI a través de un proveedor de nube, la empresa dice que está trabajando con ellos para que la marca llegue también ahí en las próximas semanas, con disponibilidad que puede variar.

Lo que todavía no se sabe

  • La fecha exacta en la Unión Europea. El anuncio solo dice «en las próximas semanas». La ayuda de OpenAI ya describe la marca en ChatGPT para la UE en presente, pero el texto fechado que fija el calendario es el anuncio.
  • Si va a llegar a América Latina. OpenAI dice que el enfoque regional le da margen para aprender del uso real y que va a revisar cada parte de su enfoque a medida que evolucionen la tecnología, los estándares y la evidencia. No hay ningún plan anunciado para ChatGPT fuera de la UE.
  • Cuándo se abre el detector. La empresa dice que va a ampliar el acceso cuando crea que los resultados se pueden interpretar de forma responsable, sin fecha.
  • El código de textGrain. OpenAI va a actualizar su informe técnico en las próximas semanas y planea publicar la tecnología como código abierto, sin fecha.

En junio, OpenAI ya había anunciado que apoyaba ese código de prácticas europeo. Lo de hoy lleva ese compromiso al texto, y viene con la letra chica a la vista: funciona mejor en textos largos, peor cuanto más se edita y, en la prueba por idioma de la propia OpenAI, el español salió primero.

Fuentes: OpenAI, «Our approach to EU text provenance rules» (5 de octubre de 2026); Centro de ayuda de OpenAI, «Provenance signals in OpenAI-generated content»; OpenAI, «Supporting Europe’s work in ensuring a trustworthy AI ecosystem» (11 de junio de 2026). Todas consultadas el 5 de octubre de 2026 y en inglés; las traducciones son nuestras.

Deja un comentario