OpenAI anunció el despliegue de su tecnología de marca de agua invisible en el texto generado por ChatGPT y Codex dentro de la Unión Europea para adecuarse a las normas de transparencia del Reglamento de IA de la UE, tras meses de debates en la industria y el antecedente de Anthropic.
En un paso significativo dentro del marco de cumplimiento regulatorio y la transparencia tecnológica, la compañía de inteligencia artificial OpenAI anunció este lunes mediante una publicación en su blog corporativo que comenzará a incorporar marcas de agua invisibles en los textos generados por sus herramientas ChatGPT y Codex dentro de la Unión Europea. La medida busca adecuarse a las normas de transparencia de la Ley de Inteligencia Artificial de la UE (EU AI Act), las cuales entraron en vigor el pasado 2 de agosto y exigen a las firmas del sector identificar el contenido generado por IA de manera que otros sistemas puedan detectarlo.
El despliegue de esta función se llevará a cabo durante las próximas semanas para los usuarios elegibles de ChatGPT y Codex en todos los planes dentro del territorio de la Unión Europea. Por su parte, los desarrolladores que utilizan la interfaz de programación de aplicaciones (API) de OpenAI en cualquier parte del mundo podrán activar esta opción para modelos seleccionados a partir de hoy, aunque la función permanecerá desactivada por defecto. OpenAI aclaró que no convertirá el marcado de texto en una configuración global predeterminada en este lanzamiento inicial.
A diferencia de un sello visible tradicional, esta marca de agua no es un símbolo físico, sino que opera ajustando sutilmente las elecciones de palabras del modelo de lenguaje. Este proceso deja un patrón imperceptible para los lectores humanos, pero plenamente reconocible por un detector especializado. Debido a que la marca queda insertada en la propia estructura del lenguaje, permanece junto al texto incluso cuando este es copiado y pegado. OpenAI aseguró que el sistema no identifica al usuario de forma individual y que no se observaron cambios significativos en el rendimiento de sus modelos con la función activada.
Junto con el anuncio, la empresa publicó un informe técnico de su método, bautizado como textGrain, elaborado en colaboración con investigadores de la Universidad de Pensilvania y la Universidad de Yale. El documento detalla el uso de una clave secreta para ordenar las predicciones de las palabras siguientes al completar una oración. Al sumar cientos de estas pequeñas modificaciones en un texto, el detector es capaz de identificar el contenido generado por inteligencia artificial utilizando únicamente el pasaje de texto y la clave secreta.
No obstante, la compañía admitió que la marca de agua puede ser vulnerada mediante la edición del texto. En las pruebas realizadas por OpenAI, sustituir tan solo el 10% de las palabras por sinónimos redujo la tasa de detección del 92% a aproximadamente un 66%. Además, la empresa señaló que los pasajes breves, las respuestas matemáticas y los textos traducidos resultan más difíciles de detectar.
“Estas limitaciones contribuyen a nuestra decisión de proporcionar un acceso inicial al detector únicamente a investigadores aprobados y organizaciones expertas, quienes pueden ayudarnos a evaluar la confiabilidad y los usos responsables.”
— OpenAI
De igual manera, la firma advirtió que la ausencia de una marca de agua en un escrito “no prueba la autoría humana”, dado que el texto podría ser muy breve, estar fuertemente editado o haber sido generado por la herramienta de otra compañía.
“[Las marcas de agua] pueden indicar que un sistema de OpenAI generó o procesó parte de un pasaje, pero no cuánta precisión de juicio humano, edición o creatividad se invirtió en él.”
— OpenAI
Este anuncio se produce dos meses después de que la firma competidora Anthropic decidiera aplicar marcas de agua al texto generado por su modelo Claude a nivel mundial, una medida que provocó rechazo entre algunos usuarios al argumentar que ellos aportaban las instrucciones, el contexto y las decisiones, mientras que la IA era simplemente la herramienta. OpenAI ya había desarrollado una tecnología similar anteriormente, pero retrasó su lanzamiento por temor a que sus usuarios migren hacia rivales que no incluyeran marcado de texto, según reveló The Wall Street Journal en 2024.
Con esta decisión, OpenAI se alinea con los compromisos asumidos por los principales gigantes del sector tecnológico, entre los que figuran Anthropic, Google, Meta, Microsoft y la propia OpenAI, para dar cumplimiento al código de prácticas sobre contenido generado por IA de la Unión Europea.

