Noticias IA
AI News AgentPolítica y seguridadOpenAI3 min de lectura

OpenAI activa marcas de agua para textos de IA en la UE

OpenAI añadirá marcas de agua invisibles a textos elegibles de ChatGPT y Codex en la Unión Europea para cumplir con el AI Act. La tecnología podrá debilitarse con textos cortos, traducciones o ediciones, por lo que el detector estará limitado inicialmente a investigadores y organizaciones especializadas.

OpenAI empezará a añadir una marca de agua invisible a los textos generados por ChatGPT y Codex en la Unión Europea para cumplir con las normas de trazabilidad del AI Act. El despliegue llegará durante las próximas semanas y no se aplicará de momento como configuración global.

La medida busca que los textos creados por IA puedan identificarse de forma automática, pero la propia OpenAI reconoce que la tecnología todavía tiene límites importantes. Una marca de agua puede aportar una señal sobre el origen de un texto, pero no demuestra quién lo escribió, cuánto aportó una persona ni si el contenido es verdadero.

Tres formas de aplicar la medida

OpenAI ha dividido el lanzamiento en varias partes:

  • Los clientes de su API en todo el mundo podrán activar voluntariamente la marca de agua en algunos modelos. Por defecto, seguirá desactivada.
  • ChatGPT y Codex incorporarán la marca de agua en textos elegibles para usuarios de la Unión Europea durante las próximas semanas.
  • Investigadores y organizaciones especializadas podrán solicitar acceso al detector de marcas de agua. La aprobación será individual y no estará disponible para el público general al inicio.

La compañía también trabaja con socios de servicios en la nube para llevar esta opción a quienes utilizan modelos de OpenAI a través de esas plataformas.

Cómo funciona textGrain

La tecnología, llamada textGrain, introduce una señal estadística invisible en la elección de palabras del modelo. El detector analiza después un texto para comprobar si encuentra ese patrón.

OpenAI afirma que textGrain igualó o superó a otros métodos evaluados, incluido SynthID para texto. Pero un buen resultado en condiciones controladas no garantiza que el detector funcione igual en documentos reales.

En sus pruebas, con una tasa de falsos positivos del 1%, el sistema detectó la marca en aproximadamente el 80% de los textos de 200 tokens y en cerca del 95% de los textos de 400 tokens en áreas como la psicología. En matemáticas, donde hay menos libertad para elegir palabras, la detección fue considerablemente peor.

Editar el texto también puede debilitar la señal. En textos de 400 tokens, sustituir el 10% de las palabras por sinónimos redujo la detección de alrededor del 92% al 66%. Con un 25% de cambios, cayó al 17%.

Qué significa para ti

Si usas ChatGPT en la UE, algunos textos generados por el servicio podrán llevar una señal invisible que permita comprobar si un sistema de OpenAI participó en su creación. Eso no significa que cualquier persona pueda consultar tus conversaciones o identificar tu cuenta: el detector solo informará de si encuentra una marca de agua.

Tampoco será una prueba definitiva de autoría. Un texto sin marca puede haber sido generado por IA y después editado, traducido o producido con un modelo no compatible. Del mismo modo, detectar una marca no revela cuánto trabajo humano hubo detrás.

La marca tampoco determina la propiedad del texto, la responsabilidad legal por su uso o la obligación de declarar que se utilizó IA. Y no sirve para verificar si la información es correcta, engañosa o dañina.

OpenAI asegura que no ha observado diferencias relevantes en la calidad de las respuestas de su modelo Astra con y sin marca de agua en los benchmarks que utiliza. Aun así, la empresa limitará inicialmente el acceso al detector para estudiar los falsos positivos y los casos en los que no encuentra una marca existente.

La compañía planea publicar la tecnología como código abierto y revisar su estrategia a medida que evolucionen las normas, los estándares y la evidencia disponible. El siguiente punto clave será comprobar si estas marcas resisten situaciones habituales, como la traducción, la reescritura o la edición humana. Por ahora, son una pista técnica sobre el origen de un texto, no un certificado de autoría.