OpenAI implementará marca de agua invisible en textos de ChatGPT en la UE

Para cumplir el AI Act de la Unión Europea, OpenAI empezará a insertar una marca de agua invisible en el texto generado por ChatGPT y Codex dentro de la UE. La señal viaja con el texto y es detectable con una clave, pero tiene limitaciones claras frente a ediciones y pasajes breves.

Por Redaccion TD
OpenAI implementará marca de agua invisible en textos de ChatGPT en la UE

Qué anunció OpenAI

OpenAI informó que, para alinearse con las normas de transparencia del AI Act de la Unión Europea, comenzará a incorporar una marca de agua invisible en el texto generado por ChatGPT y Codex para usuarios elegibles en la UE. La medida responde directamente a la obligación legal de que contenido producido o procesado por sistemas de IA pueda ser identificado por otros sistemas.

La compañía agregó que el despliegue ocurrirá en las próximas semanas para usuarios elegibles de ChatGPT y Codex en todos los planes, pero solo dentro del territorio de la UE. Para desarrolladores que usan la API de OpenAI en cualquier lugar del mundo, la funcionalidad está disponible desde hoy como opción activable por modelo, aunque permanece deshabilitada por defecto. OpenAI también dejó claro que no hará de la marcación de texto una configuración global por defecto en este lanzamiento.

Cómo funciona la “marca de agua” (textGrain)

La marca de agua no es un símbolo visible ni metadatos anexos; opera modificando sutilmente las elecciones de palabras del modelo. Es decir, el propio contenido textual lleva un patrón que no es perceptible para lectores humanos, pero sí detectable por un analizador que conozca la técnica y la clave secreta.

OpenAI publicó un informe técnico sobre el método, llamado textGrain, coescrito con investigadores de la Universidad de Pennsylvania y Yale. En términos generales, la técnica usa una clave secreta para reordenar o priorizar las predicciones de la siguiente palabra durante la generación. No se trata de un único ajuste, sino de cientos de pequeños empujes en las decisiones de palabras que, acumulados, producen un patrón estadístico detectable cuando se dispone de la clave.

Un beneficio práctico de esta aproximación es que la marca de agua viaja con el texto: al copiar y pegar un fragmento marcado, el patrón sigue presente porque está integrado en las propias palabras.

Limitaciones probadas

OpenAI reconoce varias limitaciones importantes en sus pruebas. Por ejemplo, la detección cae cuando el texto se edita: en un experimento, reemplazar el 10% de las palabras por sinónimos redujo la tasa de detección de aproximadamente 92% a 66%. Además, pasajes muy cortos, respuestas matemáticas concisas y textos traducidos resultaron más difíciles de identificar con fiabilidad.

Por esa razón, la compañía ha decidido ofrecer inicialmente acceso al detector solo a investigadores aprobados y organizaciones expertas, para evaluar su fiabilidad y usos responsables.

OpenAI además advierte que la ausencia de marca de agua no implica necesariamente autoría humana. Un texto podría no llevar la señal por ser demasiado corto, porque fue editado en exceso o porque fue generado por un sistema de otra compañía.

Alcance del despliegue y diferencias con otras compañías

El anuncio llega dos meses después de que Anthropic comunicara que aplicaría una marca de agua a Claude de forma global. La decisión de Anthropic generó reacciones entre usuarios que consideraron que ellos proporcionaban las indicaciones y el contexto, y que el modelo era solo una herramienta.

Según reportes previos de prensa, OpenAI ya había desarrollado antes una marca de agua, pero había retrasado su lanzamiento parcialmente por el temor a que algunos usuarios migraran a competidores que no marcaran sus contenidos. En el ecosistema más amplio, empresas como Anthropic, Google, Meta, Microsoft y OpenAI se han comprometido a seguir el código de práctica de la UE sobre contenido generado por IA.

Implicaciones prácticas para empresas y actores en Latinoamérica

Aunque esta marca de agua se implementa por ahora solo en la UE para usuarios de ChatGPT y Codex, tiene impactos relevantes para América Latina:

  • Desarrolladores y startups locales que consumen la API de OpenAI podrán activar la marcación en sus modelos si lo desean; la opción está disponible globalmente pero desactivada por defecto. Esto permite a equipos latinoamericanos probar y ofrecer funcionalidad que cumpla estándares europeos si sus clientes lo requieren.

  • Medios, verificadores de hecho y plataformas que distribuyen contenido transnacional deben tomar en cuenta que la presencia o ausencia de una marca no es un indicador absoluto de origen humano. Para la verificación, seguirán siendo necesarias otras herramientas y procesos editorialmente responsables.

  • Empresas que operan en mercados regulados o que exportan servicios a la UE tendrán incentivos para adoptar sistemas que incorporen marcaciones, al menos cuando su contenido llegue a audiencias europeas.

  • Reguladores latinoamericanos que analizan normas sobre AI pueden observar el caso como ejemplo de una medida técnica que busca cumplir obligaciones de transparencia, pero con limitaciones prácticas que requieren complementos normativos y procedimientos de verificación.

¿Qué pueden hacer organizaciones y decisores?

Las limitaciones técnicas dejan espacio para acciones prácticas: implementar procesos de verificación multilayer (metadatos firmados, huellas de ejecución, trazabilidad de prompts), capacitar equipos de revisión humana y diseñar políticas de uso interno que incluyan declaraciones sobre la participación de IA en la generación de contenido.

Para las empresas que ofrecen productos digitales en múltiples jurisdicciones, resulta recomendable evaluar la configuración de la API (activar la marcación cuando sea pertinente), informar a clientes sobre qué significa la presencia o ausencia de una marca, y colaborar con terceros expertos en detección para introducir controles apropiados.

Conclusión

La iniciativa de OpenAI de integrar una marca de agua invisible en textos generados por ChatGPT y Codex en la UE es un paso técnico para cumplir con el AI Act y mejorar la trazabilidad del contenido automatizado. Sin embargo, las pruebas publicadas por la propia compañía muestran que la técnica no es infalible: la edición de texto, los pasajes cortos o las traducciones reducen la detectabilidad.

Para organizaciones en Latinoamérica, la decisión subraya la importancia de combinar soluciones técnicas con prácticas organizacionales y transparencia hacia usuarios y clientes. La marca de agua puede ser una herramienta útil en la caja de herramientas para cumplimiento y verificación, pero no reemplaza procesos humanos, controles de calidad ni marcos regulatorios claros.

OpenAI continuará desplegando y evaluando la técnica, y por ahora limita el acceso al detector a investigadores y organizaciones expertas mientras se valora su fiabilidad y usos responsables. Esto deja abierta la discusión sobre cómo equilibrar innovación, transparencia y robustez frente a manipulaciones y ediciones que afectan la capacidad de identificar contenido generado por IA.

Fuente original: TechCrunch AI