OpenAI comenzará a agregar una marca de agua invisible al texto generado por ChatGPT y Codex en la Unión Europea para cumplir con la Ley de IA de la UE, dijo la compañía el lunes en una publicación de blog.
Las normas de transparencia de la Ley de IA de la UE, que entraron en vigor el 2 de agosto, exigen que las empresas de IA marquen el contenido generado por IA de una manera que otros sistemas puedan identificar.
OpenAI dijo que la marca de agua se implementará en las próximas semanas para los usuarios elegibles de ChatGPT y Codex en todos los planes, pero solo en la UE. Los desarrolladores que utilizan la API de OpenAI en cualquier parte del mundo pueden activarla para modelos seleccionados a partir de hoy; está desactivado de forma predeterminada. OpenAI dijo que no hará que las marcas de agua de texto sean un valor predeterminado global en el lanzamiento.
La marca de agua no es un símbolo real, pero funciona dando forma sutil a las palabras elegidas por el modelo, dejando un patrón que los lectores no pueden ver, pero que un detector puede captar. Debido a que vive en las palabras mismas, viaja con el texto cuando se copia y pega. OpenAI dijo que la marca de agua no identifica al usuario y que no vio ningún cambio significativo en el rendimiento de sus modelos cuando estaba encendida.
OpenAI también publicó un informe técnico sobre su método, llamado textGrain, junto con el anuncio. Coescrito con investigadores de la Universidad de Pensilvania y Yale, muestra un ejemplo del uso de una clave secreta para ordenar las predicciones de la siguiente palabra para terminar la oración. Agregue cientos de estos empujones y el detector podrá detectar contenido generado por IA usando solo el texto y la clave.
¿Se puede eliminar la marca de agua editando? Las pruebas de OpenAI sugieren que sí. En una prueba, reemplazar el 10% de las palabras con sinónimos redujo la detección de aproximadamente el 92% al 66%. La compañía también dijo que los pasajes cortos, las respuestas matemáticas y el texto traducido son más difíciles de detectar.

«Estas limitaciones contribuyen a nuestra decisión de proporcionar acceso inicial al detector sólo a investigadores aprobados y organizaciones de expertos, que puedan ayudarnos a evaluar la confiabilidad y los usos responsables», dijo la compañía.
OpenAI también advirtió que la falta de una marca de agua «no prueba la autoría humana». El texto podría ser demasiado breve o estar demasiado editado, o podría provenir de la IA de otra empresa.
“[Watermarks] «Puede indicar que un sistema OpenAI generó o procesó parte de un pasaje, pero no cuánto juicio humano, edición o creatividad se utilizó en él», dijo la compañía.
El anuncio se produce dos meses después de que Anthropic dijera que pondría una marca de agua en el texto generado por Claude, una medida que está aplicando en todo el mundo. Esa decisión provocó reacciones negativas de algunos usuarios de Claude, quienes argumentaron que habían proporcionado «las instrucciones, el contexto, las decisiones», mientras que Claude era simplemente «la herramienta».
OpenAI había creado una marca de agua de texto antes, pero pospuso su lanzamiento, en parte por la preocupación de que los usuarios cambiaran a rivales que no tuvieran marcas de agua, informó The Wall Street Journal en 2024.
Anthropic, Google, Meta, Microsoft y OpenAI se encuentran entre las empresas que se han comprometido a seguir el código de prácticas de la UE sobre contenido generado por IA.
Cuando compra a través de enlaces en nuestros artículos, podemos ganar una pequeña comisión. Esto no afecta nuestra independencia editorial.
