OpenAI is adding invisible watermarks to ChatGPT and Codex text in the EU
OpenAI se encuentra preparando la implementación de marcas de agua invisibles en los contenidos textuales creados por ChatGPT y Codex dentro del territorio de la Unión Europea. Estas marcas no se podrán apreciar a simple vista al leer o copiar el contenido, ya que la tecnología llamada textGrain modifica de forma leve la selección de palabras del modelo para generar un patrón estadístico que permita su identificación posterior. Esta funcionalidad se desplegará de manera específica para el contenido apto en dicha región durante las próximas semanas, sin establecerse todavía como una opción predeterminada a nivel global, aunque los desarrolladores de API en todo el mundo ya pueden activarla de forma opcional.
La compañía ha señalado que esta herramienta de marcado de agua presenta limitaciones, dado que las modificaciones comunes en el texto pueden disminuir notablemente la capacidad de reconocimiento. Por ejemplo, al evaluar fragmentos extensos, el reemplazo de una parte de las palabras por sinónimos reduce drásticamente la efectividad de la detección, y un resultado similar ocurre en áreas temáticas como las matemáticas, donde el modelo cuenta con menor margen para alterar su vocabulario. Debido a esto, la empresa advierte que la falta de detección no confirma que un texto haya sido escrito por una persona, ya que los contenidos pueden ser muy breves, traducidos o modificados, y la marca tampoco permite identificar la cuenta, el usuario, la instrucción original ni el nivel de intervención humana.
Paralelamente, la organización está recibiendo solicitudes para el uso de su detector de marcas de agua, aunque el acceso inicial estará restringido exclusivamente a investigadores autorizados y organizaciones expertas. Por otra parte, la firma ha indicado que el uso de este sistema no altera de forma significativa la calidad del modelo GPT-6 Astra, manteniendo resultados comparables en las pruebas de rendimiento cuando la función está activa.