IA · Noticia

OpenAI prepara marcas de agua en textos para la UE: qué deben saber las empresas

OpenAI prevé añadir en las próximas semanas una marca estadística invisible a ciertos textos de ChatGPT y Codex en la UE. Es una señal de procedencia, no una prueba de autoría o exactitud.

Una persona trabaja con un portátil en un entorno de producción de contenidos.
Una persona trabaja con un portátil en un entorno de producción de contenidos.Ilustración original de CherTra News

Qué ha anunciado OpenAI

El 5 de octubre, OpenAI presentó un enfoque gradual para la procedencia de los textos. La empresa afirma que añadirá durante las próximas semanas una marca de agua invisible a determinados textos de ChatGPT y Codex en la Unión Europea. Por separado, los clientes de API de todo el mundo podrán activarla en algunos modelos; seguirá desactivada de forma predeterminada en la API.

OpenAI también abrió solicitudes para acceder a un detector, limitado inicialmente a investigadores y organizaciones aprobados. El despliegue europeo está previsto, no se presenta como terminado. La opción de API es distinta del despliegue regional de ChatGPT y Codex, por lo que cada empresa debe confirmar qué está disponible en el producto que utiliza.

Una marca estadística, no metadatos visibles

Un texto no guarda una marca de agua como un archivo puede guardar metadatos de imagen. OpenAI explica que textGrain influye estadísticamente en la elección de palabras y que un detector busca después ese patrón en un fragmento. El método depende de que exista suficiente libertad lingüística; por ello no identifica todos los textos, temas o idiomas con la misma fiabilidad.

Según las evaluaciones publicadas por OpenAI, los textos breves o muy condicionados son más difíciles de clasificar, y las ediciones pueden debilitar la señal. Son resultados comunicados por la empresa, no una garantía para todos los idiomas, modelos, documentos o procesos editoriales.

Qué no demuestra un resultado

OpenAI señala que una marca de agua no mide la contribución humana, no determina la propiedad ni la responsabilidad, no identifica al usuario y no comprueba si el texto es correcto. Un resultado positivo es un indicio limitado de procedencia. No demuestra que alguien haya copiado el texto ni que una afirmación sea verdadera.

La ausencia de detección tampoco demuestra autoría humana: el texto puede ser breve, estar editado o traducido, proceder de un modelo no compatible o haberse creado antes del despliegue. El detector no será público al inicio, entre otros motivos por los falsos positivos y las detecciones fallidas. No debería decidir por sí solo cuestiones laborales, académicas o de cumplimiento.

El contexto europeo requiere una lectura cuidadosa

OpenAI presenta su enfoque como respuesta al Reglamento europeo de IA. El artículo 50 incluye obligaciones de transparencia para proveedores de sistemas de IA generativa, pero las obligaciones concretas dependen del papel, el sistema y el uso. El anuncio de un proveedor no sustituye al reglamento ni al análisis de un caso particular. La marca es una técnica posible, no una respuesta completa a toda obligación de transparencia.

Las empresas que publican o procesan contenido generado deberían documentar herramientas, revisión y comunicación. Los equipos deben confirmar qué modelos y ajustes de API utilizan. Para interpretar las obligaciones conviene consultar fuentes oficiales de la UE, no suponer que todos los textos asistidos por IA reciben la misma señal.

Recomendaciones prácticas para equipos de contenido

Los medios y equipos de marketing pueden considerar las señales de procedencia como una parte de un proceso más amplio. Siguen siendo necesarios la revisión humana, la comprobación de fuentes y la responsabilidad editorial. En trabajos importantes resulta más útil conservar el historial y los materiales de referencia que pedir a un detector que reconstruya quién hizo cada parte.

Los desarrolladores deberían revisar la documentación de API, los modelos compatibles y la forma de activar la función antes de basar un flujo de trabajo en la marca. En productos dirigidos a la UE, conviene describirla con precisión y explicar la incertidumbre. La procedencia automática puede complementar, pero no sustituir, la transparencia, los registros y el criterio humano.

Fuentes y lecturas adicionales

¿Quieres señalar un error factual o sugerir una fuente? Contactar con la redacción.