
OpenAI busca ahora ampliar su estrategia actual para detectar contenido generado por IA mediante la incorporación de marcas de agua en el texto de las respuestas de ChatGPT y Codex que cumplan los requisitos, en toda la Unión Europea. OpenAI afirma que iniciará el proceso de implementación en las próximas semanas para cumplir con las exigencias de la Ley de IA de la UE.
A diferencia de una etiqueta visible, la marca de agua será una señal estadística invisible integrada en el texto a medida que se genera. OpenAI afirma que el sistema está diseñado para ayudar a determinar si es probable que uno de sus modelos haya producido un texto. Sin embargo, la empresa señala que la tecnología tiene limitaciones claras y que no debe considerarse una prueba de quién creó un texto.
Cómo funciona la marca de agua de texto de OpenAI
La marca de agua de texto de OpenAI está diseñada para responder a una pregunta relativamente acotada: si es probable que un texto haya sido generado por un modelo de OpenAI. La señal se incorpora al texto durante la generación y no añade caracteres especiales, marcas visibles ni formatos inusuales. Según OpenAI, las pruebas realizadas hasta ahora han demostrado que la marca de agua no afecta la velocidad ni las capacidades de sus modelos, ni cambia de forma perceptible la manera en que se leen sus respuestas.
El sistema es distinto de una firma digital que permitiría identificar a un usuario concreto. OpenAI afirma que la marca de agua no revela quién escribió originalmente el texto, quién es su propietario ni qué cuenta, organización, conversación o indicación se utilizó. Para los clientes de API, las marcas de agua de texto ya están disponibles en determinados modelos de todo el mundo.
La reescritura puede eliminar la marca de agua
OpenAI también reconoce que las marcas de agua de texto no son un método perfecto para detectar textos generados por IA. La empresa afirma que puede ser difícil identificar la marca de agua en textos breves. Y, lo que es más importante, reescribir o traducir el contenido puede eliminar por completo la señal estadística.
Esto implica que habrá ocasiones en que al detector le resultará difícil determinar si un texto fue creado originalmente por un modelo de OpenAI, sobre todo si se ha editado ampliamente después de generarse. Por este motivo, la tecnología debería considerarse más un indicador de procedencia que un detector de IA. Un resultado positivo podría indicar que el texto fue creado originalmente por un modelo de OpenAI.
OpenAI limita el acceso a su detector
Actualmente, OpenAI limita el acceso a su detector de marcas de agua de texto a investigadores autorizados. La empresa señaló que los investigadores ayudarán a evaluar el funcionamiento del sistema e identificar formas de mejorarlo. OpenAI describió las marcas de agua de texto como un área de investigación en curso, no como una tecnología acabada.
La empresa tiene previsto seguir probando el sistema y recopilando comentarios de usuarios, desarrolladores, responsables políticos e investigadores. El lanzamiento en la UE se produce mientras los organismos reguladores y las empresas tecnológicas buscan formas de facilitar la identificación del contenido generado por IA. El enfoque de OpenAI suma el texto a sus iniciativas existentes de procedencia para imágenes y audio.
Para los usuarios de ChatGPT y Codex en la UE, el cambio significa que los textos generados que cumplan los requisitos llevarán una señal invisible diseñada para proporcionar información sobre su probable origen. Sin embargo, la propia explicación de OpenAI deja claro que la señal no puede identificar a la persona que escribió el texto y que puede eliminarse mediante ciertos tipos de edición o traducción.
Este artículo se publicó originalmente con el título OpenAI pondrá marcas de agua en los textos de ChatGPT y Codex en la UE en Crypto Breaking News, tu fuente de confianza para noticias sobre criptomonedas, Bitcoin y novedades sobre blockchain.
