OpenAI anunció que, como parte de las normas de transparencia de la Unión Europea, implementará una marca de agua invisible en los textos generados por ChatGPT y Codex dentro de la UE. El despliegue comenzará en las próximas semanas para los usuarios elegibles de esas herramientas, en todos los planes disponibles en el bloque.

En paralelo, la empresa, liderada por Sam Altman, aclaró que para los desarrolladores que usan la API la función estará disponible a partir de este lunes para ciertos modelos y en cualquier región del mundo, aunque estará desactivada por defecto y no será una función global en su lanzamiento.

La compañía afirmó en un comunicado oficial que la marca de agua no deja ningún símbolo visible para el lector. En su lugar, cambia sutilmente la selección de palabras que emplea el modelo, de modo que se genere un patrón oculto que solo puede detectarse con herramientas específicas.

OpenAI especificó que el sistema se mantiene integrado en el propio texto, de modo que el patrón persiste al copiar y pegar. También aseguraron que la marca de agua no identifica al usuario y su activación no causó cambios significativos en el rendimiento de los modelos.

Junto con el anuncio, la firma difundió un informe técnico sobre su método, denominado textGrain, desarrollado en colaboración con investigadores de la Universidad de Pensilvania y Yale. El enfoque se apoya en una clave secreta para ordenar las predicciones de la siguiente palabra y completar una oración; al combinar cientos de estas predicciones, un detector podría determinar si un contenido fue generado por IA usando únicamente el texto y la clave.

Las pruebas internas muestran ciertas limitaciones: la detección puede disminuir si se modifica el texto. Por ejemplo, substituir el 10% de las palabras por sinónimos redujo la capacidad de detección de aproximadamente el 92% a alrededor del 66%. Además, textos breves, respuestas matemáticas y contenido traducido resultan más difíciles de identificar.

Frente a estas limitaciones, OpenAI indicó que el acceso inicial al detector estará reservado a investigadores y a organizaciones autorizadas, con el fin de evaluar su fiabilidad y utilidad en distintos escenarios. La compañía señaló que la marca de agua no pretende identificar a usuarios y que su implementación no altera sustancialmente el rendimiento de los modelos.