El texto europeo generado por ChatGPT de OpenAI ahora lleva marcas de agua invisibles que permiten a grupos específicos identificar cuándo proviene de los modelos de IA de OpenAI.
En reacción al requisito de la Ley de IA de la UE de que los creadores de IA generativa muestren el texto escrito por IA en un formato que las máquinas puedan leer, OpenAI ha lanzado una tecnología de marcas de agua a la que llama «textGrain». Esa tecnología se está implementando en las salidas de texto de ChatGPT y Codex adecuadas en la UE, y la implementación se llevará a cabo en plataformas elegibles en las próximas semanas.
Cómo funciona textGrain
A diferencia de una etiqueta adjunta a una respuesta, textGrain no oculta caracteres, puntuación extraña ni espacios invisibles dentro de una respuesta. En cambio, da forma sutilmente a cómo el modelo elige entre posibles palabras y fragmentos de palabras mientras escribe texto. Ese modelado deja un patrón en un pasaje que la empresa puede buscar más tarde.
La marca de agua está incrustada dentro del texto mismo, por lo que copiar y pegar una respuesta sin modificar no la eliminará. Esa marca de agua no contiene detalles sobre la persona que escribió el texto, su grupo o la solicitud que ingresaron.
Los clientes en todo el mundo pueden seleccionar la marca de agua de texto para modelos compatibles, aunque la función comienza en un estado inactivo. OpenAI está colaborando con socios de nube y distribución para incluir señales de procedencia en las salidas que se mueven a través de sus servicios.
Quién obtiene el detector
La empresa no tiene planes actuales para proporcionar acceso a todo el mundo a la herramienta que detecta texto con marcas de agua. En cambio, está aceptando solicitudes de investigadores y grupos de expertos aprobados mientras evalúa la confiabilidad y los posibles usos de la tecnología.
La elección depende en parte de cómo funciona el detector. Un detector puede tratar mal el texto como si llevara una marca de agua o puede pasar por alto el texto que realmente la lleva. Las respuestas cortas son especialmente difíciles de encontrar, ya que pueden no contener suficiente texto para construir el patrón estadístico. El código, las respuestas matemáticas y las respuestas altamente fácticas también pueden ser más difíciles de marcar, porque el modelo tiene menos formas sensatas de expresar su salida.
Algunos de los límites provienen de las propias normas de la UE. Su Código de Conducta para contenido generado por IA establece que las salidas de menos de 200 tokens —aproximadamente 150 palabras en inglés— y fragmentos de código no necesitan una señal acuática.
Una reescritura, paráfrasis o traducción sustancial de una respuesta también puede oscurecer la señal acuática. Este proceso puede debilitar la señal o incluso hacerla imposible de detectar.
Esto significa que encontrar una señal acuática puede indicar que un sistema escribió o procesó texto, pero no puede determinar cuánto del trabajo terminado fue escrito o editado por una persona.
La ausencia de una señal acuática no prueba que un texto haya sido creado por una persona en lugar de una IA.
Lo que ya hace OpenAI
OpenAI ya utiliza sistemas de procedencia para medios creados por IA. Los Credenciales de Contenido y las señales acuáticas SynthID aparecen en imágenes producidas con herramientas compatibles, mientras que el audio escrito por IA compatible lleva SynthID. Las herramientas de verificación para imágenes y audio compatibles siguen siendo públicas, a diferencia del nuevo sistema de texto.
El último sistema marca un cambio con respecto a los esfuerzos anteriores de OpenAI para reconocer el texto escrito por IA. En 2023, la empresa finalizó su propio clasificador de IA después de admitir que sufría una «baja tasa de precisión», con la herramienta identificando correctamente el texto escrito por IA solo el 26% del tiempo en el lanzamiento.
Más de tres años después de que OpenAI anunciara que estaba investigando «técnicas de procedencia más eficaces para texto», textGrain ahora se presenta como el último intento de la empresa de hacer que el texto escrito por IA destaque sin depender únicamente de las herramientas convencionales de detección de IA.
Pruebas hasta ahora
Las pruebas de OpenAI no mostraron una disminución significativa en la calidad del modelo cuando se activó textGrain, y el efecto en la velocidad de generación fue insignificante.
El detector permanece bloqueado tras aprobaciones por el momento, pero la señal acuática está en camino de llegar pronto a ChatGPT y Codex de la UE elegibles.
Fuente: “El texto de ChatGPT está a punto de volverse detectable con una señal acuática invisible para cumplir con la ley de IA de la UE”, Dexerto.
Recibe El Cuaderno.
Las mejores historias del día y cada veredicto nuevo, en español claro, en tu correo a las siete. Un correo al día, nada más.

