OpenAI incorpora una marca de agua invisible para detectar textos generados por ChatGPT

OpenAI ha empezado a desplegar una marca de agua invisible para texto llamada textGrain, con la que busca identificar contenidos generados por sus modelos, especialmente en ChatGPT y Codex. La señal se inserta en la selección estadística de palabras durante la generación y permite a un detector comprobar si un pasaje contiene esa marca. Por ahora, el despliegue confirmado se centra en la Unión Europea y en determinadas opciones para clientes de la API.
La compañía ha vinculado esta medida a las obligaciones de transparencia de la EU AI Act y al código de buenas prácticas sobre contenido generado por IA. Según su comunicación más reciente, la expansión al texto en la UE se está realizando para cumplir ese marco regulatorio y llegará de forma progresiva en las próximas semanas. OpenAI también deja claro que el sistema no funciona como un detector genérico de inteligencia artificial, sino como una verificación de una señal incorporada en el contenido por sus propios modelos.
Qué ha anunciado exactamente OpenAI
La novedad principal es la incorporación de una marca de agua para texto que no resulta visible para el usuario. A diferencia de otras técnicas más obvias, no se basa en caracteres ocultos, cambios de formato ni patrones extraños de puntuación. OpenAI explica que la señal se integra en la forma en que el modelo selecciona las palabras, de manera que un detector pueda evaluar después si ese fragmento de texto procede de sus sistemas.
Esta funcionalidad se está aplicando a texto generado por ChatGPT y Codex en la UE. Además, para clientes de la API, OpenAI permite activar la marca de agua de forma voluntaria a nivel de proyecto u organización. Es decir, no se trata de una activación universal para todo el mundo, sino de un despliegue más limitado y gradual.
La empresa distingue además entre tipos de contenido. En el caso del texto, la señal es textGrain; para imagen y audio, OpenAI emplea otras soluciones de procedencia, como SynthID y C2PA/Content Credentials. Esa diferenciación es importante porque la medida no implica una única tecnología aplicada por igual a todos los formatos generados por IA.

Cómo funciona la marca de agua invisible
OpenAI describe textGrain como una señal estadística. En la práctica, eso significa que la marca se introduce en el proceso de selección de palabras durante la generación del texto. No cambia necesariamente el aspecto visible del contenido, pero sí deja un patrón que un sistema de detección puede reconocer si el texto no ha sido modificado en exceso.
La compañía sostiene que el objetivo es ofrecer una solución de procedencia más robusta que las marcas tradicionales y que permita verificar si un texto ha sido producido por sus modelos. Sin embargo, esa verificación no es absoluta ni universal. El propio OpenAI subraya que la ausencia de marca detectada no demuestra que un texto sea humano.
Ese matiz es relevante: un texto puede no mostrar la señal porque haya sido generado por un modelo no compatible, porque se haya creado antes de que la función existiera o porque haya sufrido cambios posteriores. En otras palabras, el sistema sirve para identificar la procedencia cuando la marca está presente, pero no para descartar de forma concluyente la intervención de IA cuando no aparece.
Qué puede y qué no puede hacer el detector
OpenAI ha precisado que el detector asociado a textGrain no será accesible de forma general al inicio. El acceso queda limitado a investigadores y organizaciones expertas o aprobadas, con el objetivo de evaluar la tecnología antes de una posible ampliación.
La empresa también advierte de varias limitaciones. Los textos muy breves, los textos editados de forma sustancial, los traducidos o aquellos que tienen restricciones muy marcadas son más difíciles de detectar. Además, la eficacia puede variar según el idioma. En ejemplos publicados por la propia compañía, la detección pierde fuerza a medida que el texto sufre cambios importantes.
Por eso OpenAI insiste en que su herramienta no debe interpretarse como un “detector de IA” general. Su función es comprobar una marca de agua específica de OpenAI, no evaluar de manera infalible si cualquier texto del mundo fue escrito por una persona o por un modelo. Esa diferencia técnica y conceptual es clave para entender el alcance real de la medida.
Por qué OpenAI la activa ahora
La motivación declarada por OpenAI es el cumplimiento de la normativa europea y de los compromisos de transparencia sobre contenido generado por IA. La compañía enmarca este despliegue dentro de su estrategia para hacer más verificable el origen de los textos producidos por sus modelos en la UE.
Según la información oficial, OpenAI también presenta esta línea de trabajo como una vía para avanzar hacia una procedencia de contenidos más interoperable y resistente. Esa afirmación procede de la propia empresa y debe entenderse como parte de su posición técnica y regulatoria, no como una conclusión independiente contrastada por terceros en el material revisado.
El contexto regulatorio explica buena parte del movimiento. La UE está exigiendo cada vez más transparencia sobre los contenidos generados por sistemas de IA, y OpenAI busca alinear sus herramientas con esas obligaciones. En ese marco, la marca de agua invisible aparece como un mecanismo para facilitar la señalización de contenido sintético sin alterar de forma visible la experiencia de uso.
Qué impacto puede tener para usuarios y empresas
Para los usuarios de ChatGPT en la UE, la medida puede traducirse en que determinados textos generados por el servicio incorporen una señal de procedencia que no será visible a simple vista, pero sí detectable por herramientas autorizadas. En el caso de la API, las organizaciones podrán decidir si activan o no esa opción en sus proyectos.
Para empresas, medios o instituciones que trabajen con contenido generado por IA, la novedad puede facilitar mecanismos internos de control y trazabilidad. Aun así, la información disponible indica que la herramienta no resuelve por completo el problema de atribución. Si un texto se edita o se reutiliza fuera del entorno original, la señal puede degradarse o desaparecer.
Eso significa que, en la práctica, la marca de agua puede ayudar a identificar parte del contenido generado por OpenAI, pero no elimina la necesidad de otras comprobaciones editoriales, legales o técnicas cuando la procedencia de un texto sea relevante.
Lo que sigue sin estar confirmado
Conviene separar lo anunciado por OpenAI de lo que todavía no puede darse por hecho. Lo confirmado es el despliegue de textGrain para texto en la UE, la opción opt-in para ciertos clientes de la API y el acceso restringido al detector. Lo que no está confirmado como hecho general es que la marca de agua esté ya disponible para todos los usuarios de ChatGPT en todo el mundo.
Tampoco puede afirmarse que este sistema permita identificar con certeza absoluta cualquier texto generado por IA. La propia documentación de OpenAI reconoce límites importantes, especialmente en textos cortos, modificados o traducidos. Por tanto, la utilidad de la herramienta depende del contexto y de las condiciones en que el contenido haya sido creado y posteriormente tratado.
La compañía ha señalado que el despliegue para ChatGPT y Codex en la UE llegará en las próximas semanas, pero ese calendario aún está pendiente de completarse. Hasta entonces, la medida debe entenderse como un proceso de implantación en marcha y no como una función plenamente universal.
En conjunto, el anuncio refuerza una tendencia cada vez más visible en la industria: la búsqueda de sistemas que permitan reconocer la procedencia del contenido generado por IA sin alterar de forma perceptible la experiencia del usuario. En el caso de OpenAI, ese camino pasa ahora por textGrain, una marca de agua invisible que ya ha empezado a activarse con foco regulatorio en Europa.

Deja una respuesta