OpenAI comenzará a añadir marcas de agua invisibles a determinados resultados de texto de los modelos de ChatGPT y Codex para los usuarios ubicados en la Unión Europea durante las próximas semanas, informó la empresa el lunes.

El sistema de marcas de agua de OpenAI es opcional para los clientes de API de todo el mundo. El sistema identificará de forma invisible como generado por IA el texto producido por determinados modelos de IA a partir del 5 de octubre, aunque la función permanecerá desactivada de forma predeterminada. OpenAI atribuyó el despliegue de la función a los requisitos de transparencia de la Ley de IA de la UE, un esfuerzo del organismo para reducir los deepfakes y el texto manipulado «publicado con el propósito de informar al público sobre asuntos de interés público».

El sistema de marcas de agua, al que la empresa llama textGrain, incorpora un patrón estadístico en las elecciones lingüísticas específicas del modelo, pero no debería alterar la fiabilidad general de sus resultados, ya que las marcas de agua no produjeron diferencias significativas de rendimiento en las pruebas de referencia de OpenAI, afirmó la empresa. OpenAI dijo que planea publicar la tecnología como código abierto, aunque al principio su detector solo estará disponible para investigadores aprobados y organizaciones especializadas.

Sin embargo, las pruebas internas de la empresa muestran que la edición puede alterar fácilmente la detección de la marca de agua. En una prueba con pasajes breves de 400 tokens, sustituir solo una de cada diez palabras por un sinónimo redujo la detección correcta de aproximadamente un 92 % a un 66 %. Sustituir una cuarta parte de las palabras por sinónimos redujo la detección a tan solo un 17 % en una de las pruebas de la empresa.

Anthropic ya ha dado un paso similar con las marcas de agua. Como informó The Latent cuando se lanzó Claude Fable 5.1, su sistema de marcas de agua, igualmente invisible, provocó objeciones de usuarios preocupados por que incluso una ayuda mínima de la IA pudiera hacer que su trabajo fuera señalado, o por que las marcas de agua hicieran que los resultados de los modelos fueran inferiores. Fable 5.1 ocupa actualmente el tercer puesto entre los modelos mejor clasificados según la prueba de referencia de The Latent, por detrás de GPT-6 Astra de OpenAI y Opus 5.5 de Anthropic.

Según las pruebas de OpenAI, los pasajes breves y los temas con poca flexibilidad en la redacción, como las matemáticas, también resultaron más difíciles de detectar, ya que existe «menos flexibilidad en la elección de palabras».

OpenAI afirmó que sus marcas de agua no pueden determinar «quién es el propietario del texto, si su uso fue lícito, si era obligatorio divulgarlo o quién es responsable de él». El sistema también puede no reconocer textos generados por otros modelos o por modelos anteriores de OpenAI y, por tanto, la ausencia de una marca de agua no demuestra que un humano haya escrito el pasaje, según la empresa.