El lunes, OpenAI detalló cómo funcionará conforme a las normas de la UE su marca de agua para los textos generados por ChatGPT; al principio, la detección estará limitada a los investigadores y no estará disponible para el público.

Conclusiones principales

  • OpenAI detalló una marca de agua para los textos generados por ChatGPT conforme a las normas de la UE; al principio, solo los investigadores podrán detectarla

  • La Ley de IA de la UE exige que los proveedores de IA de propósito general hagan que los textos sintéticos sean legibles por máquina y detectables como generados o manipulados artificialmente

  • El método de OpenAI inserta un patrón estadístico en las elecciones de tokens de ChatGPT que los algoritmos de comparación pueden detectar

  • Reformular o traducir automáticamente un texto puede debilitar las señales de la marca de agua, y OpenAI no publicó cifras sobre su resistencia frente a ataques adversarios

La marca de agua de texto de OpenAI y el cumplimiento de la normativa de la UE

La publicación explica dónde se aplica la marca de agua, cómo pueden detectarla terceros y por qué OpenAI empieza por los investigadores.

La Ley de IA de la UE exige a los proveedores de sistemas de IA de propósito general que generen textos sintéticos garantizar que los resultados estén «marcados en un formato legible por máquina y sean detectables como generados o manipulados artificialmente». Así, la responsabilidad de cumplir recae en empresas como OpenAI, no en los usuarios ni en las plataformas.

La publicación de OpenAI describe la inserción de un patrón estadístico en las elecciones de tokens que hace ChatGPT al generar texto. El método modifica la selección de palabras de maneras imperceptibles para los lectores, pero detectables por un algoritmo de comparación.

Lee también: OpenAI revela un segundo ataque con un agente rebelde contra el sitio del Gobierno de Nueva Gales del Sur

OpenAI afirmó que primero pondrá sus herramientas de detección de marcas de agua de texto a disposición de un grupo limitado de investigadores, antes de cualquier lanzamiento más amplio. Sostuvo que este enfoque gradual es necesario para evitar que actores malintencionados descifren el patrón antes de que se prueben las medidas de protección.

Las disposiciones de transparencia de la Ley de IA de la UE para los modelos de propósito general entraron en vigor en agosto, como parte de una implementación gradual que ya ha obligado a los laboratorios a documentar los datos de entrenamiento y las evaluaciones de riesgos.

Para OpenAI, la cuestión operativa ahora es si su sistema de etiquetado puede resistir el escrutinio y cumplir el requisito de la norma de que los textos generados por máquinas sigan siendo detectables. La divulgación de su marca de agua amplía específicamente ese esfuerzo de cumplimiento al etiquetado de contenidos.

Lo que está en juego va más allá del mero cumplimiento normativo

A medida que los textos generados por IA inundan las aulas, las redacciones y las redes sociales, un método de detección fiable y respaldado por laboratorios podría convertirse en el estándar de referencia que adopten otras jurisdicciones, del mismo modo que el marco de consentimiento del RGPD se convirtió en un modelo global más allá de las fronteras europeas.

Sigue sin resolverse qué tan resistente es la marca de agua frente a intentos deliberados de eliminarla, ya que reformular o traducir automáticamente un pasaje puede debilitar las señales estadísticas que dependen de elecciones exactas de tokens.

OpenAI no publicó cifras sobre la resistencia frente a ataques adversarios en la publicación del lunes, por lo que investigadores independientes tendrán que poner a prueba esta afirmación cuando se amplíe el acceso al detector.

Lee también: Las reservas de Ether de Bitmine superan los 6 millones de tokens, valorados en 16.400 millones de dólares