OpenAI anunció que empezará a insertar marcas de agua invisibles en los textos que generan ChatGPT y Codex para usuarios de la Unión Europea, en respuesta a las reglas de transparencia del Reglamento de IA del bloque. La medida se aplicará en las próximas semanas a todos los planes del chatbot en la región. Cómo funciona la marca invisible La tecnología se llama textGrain y añade una señal estadística imperceptible en la elección de palabras que hace el modelo al redactar un texto. Un detector propio de OpenAI puede luego analizar un fragmento y estimar si fue generado con sus sistemas. La empresa explicó que los clientes que usan su interfaz de programación (API) en cualquier país del mundo pueden activar esa marca de manera opcional para determinados modelos. La función permanece desactivada por defecto y queda a criterio de cada desarrollador.
Por ahora, el acceso al detector no es público. OpenAI abrió una convocatoria para que investigadores y organizaciones especializadas soliciten permiso de uso, en línea con el Código de Prácticas de la Unión Europea sobre transparencia de contenido generado con inteligencia artificial, que la compañía firmó en junio.
El mandato legal detrás del anuncio
El Artículo 50 del Reglamento de IA de la Unión Europea exige a las empresas que ofrecen sistemas de inteligencia artificial generativa hacer que sus resultados sean identificables de forma legible por máquinas. Esa obligación de transparencia empezó a regir de forma general el 2 de agosto.
OpenAI no es la primera en responder a esa norma. Según reconstruyó el sitio especializado Tech Startups, Anthropic había introducido marcas de agua invisibles para los modelos compatibles de Claude menos de dos meses antes, y optó por aplicarlas en todo el mundo desde el lanzamiento porque, según explicó esa empresa, todavía no cuenta con una forma estable de limitarlas solo a Europa.
OpenAI eligió el camino inverso: restringir el despliegue a la Unión Europea por ahora y dejarlo como opción voluntaria en el resto del planeta. “No estamos convirtiendo la marca de agua en texto en un estándar global por defecto en este lanzamiento”, señaló la empresa en su comunicado, según el cual ese enfoque regional le permite aprender del uso real antes de expandirlo.
Los límites que la propia empresa reconoce
Un informe técnico publicado el mismo día, firmado por investigadores de OpenAI junto a académicos de la Universidad de Pensilvania y la Universidad de Yale, detalla el método matemático detrás de textGrain y sus resultados de laboratorio.
Con una tasa de falsos positivos fijada en apenas 1%, el detector identificó la marca en alrededor del 80% de los fragmentos de 200 palabras evaluados y en cerca del 95% de los fragmentos de 400 palabras, usando como prueba textos de divulgación general. El desempeño cae de forma marcada en contenidos donde las palabras tienen menos alternativas posibles, como los textos matemáticos.
El propio informe admite que la marca se degrada rápido si el texto se edita. Al reemplazar el 10% de las palabras de un fragmento por sinónimos, la detección bajó de cerca de 92% a 66%; al reemplazar el 25%, cayó a apenas 17%. OpenAI aclaró además que una marca detectada no permite identificar a qué usuario, cuenta o conversación pertenece el texto.

La compañía dijo que no observó diferencias relevantes de calidad en las respuestas de su modelo más reciente, Astra, al comparar las versiones con y sin la marca activada, de acuerdo con las pruebas internas que usa habitualmente para evaluarlo.
OpenAI adelantó que planea publicar más detalles técnicos y eventualmente liberar textGrain como herramienta de código abierto. La compañía ya ofrecía antes verificación pública de procedencia para imágenes y audio a través de su sitio openai.com/verify y de una interfaz de programación dedicada, herramientas que según la empresa seguirán disponibles sin cambios.
.
