OpenAI Implementará Marcas de Agua en Textos de ChatGPT para Cumplir con la Ley de IA de la UE
El panorama regulatorio de la inteligencia artificial en Europa está marcando el ritmo al que las grandes compañías tecnológicas deben adaptarse. OpenAI ha dado uno de los pasos más concretos y significativos en esta dirección al anunciar la implementación de marcas de agua invisibles en los textos generados por ChatGPT y Codex dentro del territorio de la Unión Europea. Esta decisión responde directamente a los requisitos establecidos por el Reglamento Europeo de Inteligencia Artificial, conocido como AI Act, y abre un debate fundamental sobre la transparencia, la autenticidad del contenido digital y los límites reales de la tecnología de marcado.
¿Qué Ha Anunciado Exactamente OpenAI?
OpenAI confirmó el 5 de octubre de 2026 que comenzará a insertar marcas de agua en el contenido textual producido por sus modelos de lenguaje más utilizados: ChatGPT y Codex. Estas marcas son completamente invisibles para cualquier lector humano, pero pueden ser identificadas mediante herramientas técnicas específicas diseñadas con ese propósito.
El anuncio no llega de forma aislada. Está directamente impulsado por las exigencias del AI Act de la Unión Europea, que obliga a los proveedores de sistemas de inteligencia artificial de propósito general a garantizar que los contenidos generados por sus modelos sean identificables como tal, especialmente cuando pueden confundirse fácilmente con texto escrito por personas.
Sin embargo, la propia OpenAI ha sido transparente respecto a una limitación crítica del sistema: la edición del texto generado puede dificultar considerablemente la detección de las marcas. Esto significa que si un usuario modifica, parafrasea o reformatea el contenido producido por ChatGPT, la fiabilidad del sistema de marcado se reduce de forma significativa. Este reconocimiento abre importantes interrogantes sobre la efectividad real de la medida.
El AI Act: El Marco Regulatorio Más Ambicioso del Mundo
Para entender el alcance de la decisión de OpenAI, es necesario comprender el contexto regulatorio que la motiva. El Reglamento de Inteligencia Artificial de la Unión Europea fue aprobado formalmente en mayo de 2024 y publicado en el Diario Oficial de la UE en julio del mismo año. Es considerado, sin ninguna exageración, el marco normativo más completo y ambicioso del mundo en materia de inteligencia artificial.
El AI Act clasifica los sistemas de IA según su nivel de riesgo —inaceptable, alto, limitado y mínimo— e impone obligaciones proporcionales a cada categoría. Para los modelos de IA de propósito general, como los que dan vida a ChatGPT, el reglamento establece requisitos muy específicos:
Transparencia obligatoria: Los usuarios deben ser informados de forma clara cuando están interactuando con un sistema de inteligencia artificial.
Marcado de contenido sintético: Los contenidos de texto, imagen, audio y vídeo generados por IA deben ser identificables mediante tecnologías como las marcas de agua u otros mecanismos de etiquetado digital.
Documentación técnica exhaustiva: Los proveedores están obligados a mantener documentación detallada y actualizada sobre el funcionamiento de sus modelos.
Cumplimiento de derechos de autor: Los sistemas de IA deben respetar la legislación europea en materia de propiedad intelectual, lo que incluye declarar el uso de datos de entrenamiento con derechos reservados.
Las sanciones por incumplimiento son contundentes: hasta 35 millones de euros o el 7% de la facturación global anual para las infracciones más graves, y hasta 15 millones de euros o el 3% de la facturación global para otras violaciones del reglamento. Estas cifras explican la urgencia con la que compañías como OpenAI, Google DeepMind, Anthropic y Meta están acelerando sus planes de adaptación normativa en Europa.
La Tecnología Detrás de las Marcas de Agua en Texto
Incorporar marcas de agua en texto generado por inteligencia artificial es técnicamente mucho más complejo que hacerlo en imágenes o archivos de audio. Una fotografía tiene una estructura binaria que permite insertar metadatos o patrones visuales imperceptibles sin alterar su apariencia. El texto, en cambio, es inherentemente modificable y maleable, lo que convierte este reto en uno de los más desafiantes de la ingeniería de IA actual.
Existen principalmente dos grandes enfoques para abordar este problema:
Marcado durante la generación: Este método, desarrollado y popularizado por investigaciones académicas de instituciones como la Universidad de Maryland, implica modificar el proceso de selección de palabras durante la propia generación del texto. El modelo sesga ligeramente su elección hacia ciertos conjuntos de palabras predefinidas, creando un patrón estadístico que puede ser detectado posteriormente. Es el enfoque más robusto, pero no es inmune a la manipulación.
Marcado post-generación: Este segundo enfoque inserta señales en el texto ya generado, mediante la sustitución de sinónimos, la alteración del orden de ciertos elementos o la modificación de patrones de puntuación. Aunque es más sencillo de implementar, resulta considerablemente más frágil frente a cualquier edición posterior del texto.
El sistema que OpenAI planea implementar parece basarse en técnicas de marcado durante la generación, aunque la compañía no ha detallado públicamente la arquitectura técnica exacta de su solución. La propia admisión de que la edición puede degradar la detección confirma que existe un nivel de vulnerabilidad inherente, ya que investigaciones académicas han demostrado que incluso los métodos más robustos pueden ser eludidos mediante técnicas como la paráfrasis automática, la traducción a otro idioma y vuelta al original, o la edición manual de una porción suficiente del texto.
El Caso Particular de Codex y el Código de Programación
La inclusión de Codex en el esquema de marcado de agua merece una atención especial. Codex es el modelo de OpenAI especializado en la generación de código de programación y es el motor que impulsa herramientas de uso masivo como GitHub Copilot, ampliamente adoptada en entornos de desarrollo de software profesional en todo el mundo.
El marcado de código generado por IA plantea desafíos adicionales y específicos. El código es aún más susceptible a la modificación que el texto natural: los desarrolladores habitualmente adaptan, refactorizan, combinan y reorganizan fragmentos de código en su trabajo cotidiano. Además, la funcionalidad de un programa depende de su estructura exacta, por lo que las marcas de agua no pueden alterar la lógica del código sin provocar errores de ejecución.
La decisión de extender el marcado al código generado responde a preocupaciones crecientes en la industria del software sobre la atribución de autoría, el respeto a las licencias de código abierto y la posibilidad de que código generado por inteligencia artificial sea presentado como trabajo original humano en contextos académicos, laborales o comerciales. Estas preocupaciones no son menores: afectan directamente a la integridad profesional y a los modelos de negocio de miles de empresas tecnológicas.
Reacciones del Sector: Una Industria en Movimiento
La medida de OpenAI no surge en el vacío, sino en un contexto en el que otras grandes empresas tecnológicas también están desarrollando e implementando sistemas similares. Google DeepMind desarrolló SynthID, una tecnología de marcado de agua para contenidos generados en texto, imagen, audio y vídeo. Google anunció que SynthID para texto estaba disponible en su modelo Gemini y que lo ofrecería de forma gratuita a la comunidad de código abierto, lo que representa un enfoque diferente al de OpenAI en términos de apertura tecnológica.
Esta competencia entre empresas por demostrar su compromiso con la transparencia y el cumplimiento normativo tiene un efecto positivo para los usuarios y para la sociedad en general: acelera el desarrollo de estándares técnicos comunes y empuja a toda la industria hacia una mayor responsabilidad en la difusión de contenido generado por IA.
Sin embargo, los expertos en seguridad digital y los investigadores especializados en detección de contenido sintético advierten que ningún sistema de marcado es infalible. La carrera entre las técnicas de marcado y las de evasión es continua y dinámica, y exige una actualización constante de los métodos empleados.
Implicaciones para Usuarios, Creadores y Empresas
Para los millones de usuarios de ChatGPT en Europa, esta medida tiene implicaciones directas y concretas. En primer lugar, los contenidos que generen con la herramienta llevarán una huella digital que, al menos en teoría, permitirá identificar su origen artificial. Esto es especialmente relevante en contextos como el periodismo, la educación, la contratación profesional o la creación literaria, donde la autenticidad del contenido tiene un valor intrínseco.
Para las empresas que utilizan las APIs de OpenAI para desarrollar productos y servicios, el cumplimiento del AI Act se convierte en una responsabilidad compartida. No basta con que OpenAI implemente las marcas de agua: las empresas también deben garantizar que sus propias prácticas de uso, edición y distribución del contenido generado no contravengan el espíritu ni la letra del reglamento europeo.
Para los creadores de contenido digital, periodistas, escritores y comunicadores, la implementación de estas marcas representa tanto una oportunidad como un desafío. Una oportunidad, porque fortalece la diferenciación entre contenido humano y contenido artificial en un mercado cada vez más saturado de texto generado por máquinas. Un desafío, porque obliga a replantearse los flujos de trabajo, los criterios de verificación y los estándares de autenticidad en la producción de contenidos.
El Debate de Fondo: ¿Serán Suficientes las Marcas de Agua?
Más allá de los aspectos técnicos y regulatorios, la iniciativa de OpenAI reabre un debate de mayor calado: ¿son las marcas de agua la solución adecuada para garantizar la transparencia en el uso de la inteligencia artificial generativa?
Los defensores de este enfoque argumentan que, aunque imperfecto, el marcado de agua establece un estándar técnico mínimo que facilita la verificación, disuade el uso fraudulento del contenido generado y crea una infraestructura de trazabilidad que puede mejorarse con el tiempo.
Los críticos, en cambio, señalan que un sistema que admite abiertamente sus propias limitaciones frente a la edición simple no puede considerarse una salvaguarda robusta. Proponen que la transparencia real requiere soluciones complementarias: etiquetado visible y obligatorio del contenido generado por IA, educación digital generalizada, y herramientas de detección accesibles para el público general, no solo para actores institucionales o técnicos.
La realidad, probablemente, se encuentra en algún punto intermedio. Las marcas de agua son una pieza necesaria pero no suficiente de un ecosistema más amplio de gobernanza de la inteligencia artificial. Su verdadero valor dependerá de la capacidad de los reguladores, las empresas tecnológicas y la sociedad civil para construir juntos un marco de verificación que sea al mismo tiempo robusto, accesible y adaptable a la velocidad de cambio de esta tecnología.
Conclusión: Un Paso Adelante en un Camino Largo
La decisión de OpenAI de implementar marcas de agua en los textos generados por ChatGPT y Codex en el territorio de la Unión Europea es, sin duda, un paso relevante y bienvenido hacia una mayor transparencia en el uso de la inteligencia artificial generativa. Representa también un reconocimiento explícito por parte de una de las empresas más influyentes del mundo de que la regulación europea no es una amenaza, sino un marco dentro del cual es posible y necesario operar de forma responsable.
No obstante, las propias limitaciones técnicas admitidas por la compañía nos recuerdan que estamos ante el inicio de un proceso, no ante su conclusión. La efectividad real de esta medida dependerá de la robustez técnica del sistema implementado, de la capacidad de los organismos reguladores europeos para supervisar su cumplimiento y de la voluntad del conjunto del sector para adoptar estándares comunes que pongan la transparencia y la confianza en el centro de la industria de la inteligencia artificial.
El AI Act europeo ha lanzado la señal de salida. Ahora comienza la verdadera carrera.