IA

OpenAI pone marca de agua invisible a ChatGPT, pero solo en Europa y por obligación

Adrian Kessler
Añádenos en Google

Durante mucho tiempo, OpenAI explicó públicamente por qué no pondría una marca de agua en los textos de ChatGPT. Ahora, de todos modos, va a hacerlo. No fue la tecnología la que la hizo cambiar de opinión, sino una ley con plazo y multa incluidos.

La empresa afirma que los textos que ChatGPT y Codex generen para usuarios de la Unión Europea llevarán una firma estadística invisible, que se implementará gradualmente durante las próximas semanas en todos los planes. En el resto del mundo, la misma marca existe únicamente como una opción en la API para desarrolladores, y viene desactivada de fábrica. La línea que trazó OpenAI coincide con la frontera de la jurisdicción que puede sancionarla.

Cómo funciona la marca de agua de ChatGPT

El método, llamado textGrain, no añade nada visible al resultado. Cuando varias palabras siguientes podrían encajar casi igual de bien en una oración, una clave secreta inclina la elección hacia una de ellas. Un solo empujoncito no significa nada. Pero cientos a lo largo de un texto forman un patrón que un detector con la clave puede comprobar y, como la señal está en las propias palabras, sobrevive a copiar y pegar. OpenAI elaboró el informe técnico junto con investigadores de la University of Pennsylvania y Yale. El informe no registra un costo significativo en calidad: en el Artificial Analysis Intelligence Index, los resultados con marca de agua obtuvieron 49.76, frente a 49.57 sin ella.

La herramienta que OpenAI ya tenía

Nada de esto es nuevo dentro de OpenAI. En el verano de 2024, The Wall Street Journal informó que la empresa tenía una marca de agua de texto funcional, considerada 99.9% efectiva en documentos internos, pero que había decidido no lanzarla. OpenAI respondió que estaba adoptando “un enfoque deliberado”. Los motivos que dio eran técnicos y sociales: el método era “trivial de eludir para actores malintencionados” mediante la traducción o la reformulación con otro modelo, y podía estigmatizar la IA como herramienta de escritura para quienes no tienen el inglés como lengua materna. Al informar sobre el anuncio de esta semana, TechCrunch recuerda un tercer motivo de aquel periodo: la preocupación de que los usuarios se pasaran a competidores que no usaran marcas de agua.

A la luz de esos antecedentes, el nuevo despliegue deja ver cuáles de esas preocupaciones ha resuelto realmente OpenAI. El problema de la evasión sigue ahí, según las propias cifras de la empresa. El comercial, en cambio, quedó limitado a un solo mercado.

Las cifras de OpenAI, no las de sus críticos

En condiciones favorables y con una tasa de falsos positivos del 1%, el detector identifica alrededor del 80% de los textos con marca de agua de 200 tokens, y cerca del 95% cuando tienen 400. Si se sustituye el 10% de las palabras por sinónimos, la detección cae del 92% al 66%. Si se sustituye una cuarta parte, baja al 17%. Las respuestas cortas, las matemáticas y los textos traducidos son muy difíciles de detectar. La propia OpenAI advierte que un buen desempeño en condiciones ideales “no garantiza una detección confiable en el uso cotidiano” y que la ausencia de una marca de agua no demuestra que el texto sea obra de una persona. También señala que la marca no permite identificar al usuario.

Eso convierte a textGrain en una señal útil para detectar un copia y pega descuidado, pero poco eficaz contra quien esté dispuesto a dedicar un minuto a editar el texto. En un bloque donde se lee y se escribe en muchos idiomas, la brecha que dejan las traducciones no es un detalle menor.

Por qué la UE y por qué ahora

El impulso legal viene del artículo 50 de la AI Act, cuyas normas de transparencia entraron en vigor el 2 de agosto. La norma exige que los proveedores de sistemas generativos marquen los textos, audios, imágenes y videos sintéticos de una forma legible por máquinas, y que ofrezcan un mecanismo de detección. Los sistemas que ya estaban en el mercado antes de esa fecha, incluido ChatGPT, tienen hasta el 2 de diciembre para cumplir. Las infracciones pueden costar hasta 15 millones de euros o el 3% de la facturación anual mundial, lo que sea mayor, según un análisis del despacho de abogados Cooley.

Hay dos detalles que muestran hasta qué punto el despliegue responde a la obligación y no a un principio. El primero es el detector. La ley pide un mecanismo de detección; OpenAI creó uno y solo se lo ha entregado a investigadores aprobados y organizaciones expertas, que deben solicitar acceso. La empresa afirma que ampliará el acceso “cuando consideremos que los resultados pueden interpretarse de manera responsable”, según informa The Decoder, pero no ha dado ningún plazo. Hoy, un profesor o editor en Lisboa o Varsovia que tenga un texto sospechoso no puede comprobarlo.

El segundo detalle es el mapa. Anthropic, que empezó a poner marcas de agua en los textos de Claude en agosto, las aplica en todo el mundo, sin importar cómo accedan las personas a sus modelos, y recibió críticas de algunos usuarios por ello. OpenAI eligió lo contrario: activada de forma predeterminada donde un regulador puede multarla, opcional para los desarrolladores en el resto del mundo y sin activación global por defecto en el lanzamiento. Si hubiera desaparecido el antiguo temor a que los usuarios se fueran con competidores sin marcas de agua, habría pocos motivos para trazar el mapa de esta manera.

Qué viene ahora

OpenAI afirma que publicará textGrain como código abierto y que iguala o supera métodos como SynthID de Google. Ambas afirmaciones podrán comprobarse cuando el código sea público. La pregunta para Bruselas es más concreta: si una marca que se desvanece con una edición ligera y que casi nadie puede verificar con un detector cumple una norma concebida para que otros sistemas puedan reconocer textos generados por IA.

Después del 2 de diciembre, los únicos usuarios de ChatGPT cuyos textos llevarán por defecto la firma de OpenAI serán aquellos cuyo regulador pueda pasarle la cuenta.

Etiquetas: , , , ,

Añádenos en Google

Discussion

There are 0 comments.