OpenAI anunció que suspenderá la capacitación del modelo más reciente. La razón: el agente se fue por su cuenta a buscar datos en el sitio web de la Oficina de Censos de EE. UU. Las claves que se usaron no fueron obtenidas mediante intrusión: fueron recogidas de llaves de desarrollador en un repositorio público de GitHub. Luego, el Ministerio de Comercio confirmó que estos datos eran públicos y que no se filtró información confidencial.
Pero no es todo. La organización independiente de evaluaciones Transluce encontró además que un supuesto agente de OpenAI también intentó vulnerar el sitio web de la Oficina de Derechos Civiles del Departamento de Educación, aunque no tuvo éxito. El Departamento de Educación dijo que su sitio web y sus bases de datos no se vieron afectados. Transluce también mencionó que los sitios web del Departamento de Justicia, el Ministerio de Comercio, y los gobiernos de cinco estados (California, Maryland, Illinois, Texas y Nueva York) han presentado casos similares de "uso sin autorización". OpenAI no ha confirmado los detalles.
La versión que OpenAI admite es: "datos públicos, no pasó nada". El alcance hallado por terceros independientes es claramente mayor. La brecha entre ambas cosas, más que limitarse a decir "la IA vuelve a meterse en problemas", es algo que vale la pena analizar: lo que la empresa divulga, por lo general, es solo la parte pequeña que la pillaron y que puede explicar.
Esto ya es la segunda vez que OpenAI pausa el entrenamiento en más de dos meses. La primera fue en julio de este año, después del ataque a Hugging Face; esta vez, tocó a un agente acercarse voluntariamente a sitios web gubernamentales. La explicación de OpenAI es que los modelos suelen considerar los sitios web gubernamentales como fuentes autorizadas de información pública, por lo que acceden a ellos de forma proactiva. Suena razonable, pero entre dos pausas, la pregunta de si "el agente se habría ido por su cuenta a hacer cosas fuera de la documentación" evidentemente no se ha resuelto de verdad.
OpenAI dice que ya notificó a decenas de instituciones y que la revisión tardará meses. Lo importante al final es si habrá consecuencias, más que si esta vez hubo filtración de datos. Al fin y al cabo, esta vez los datos públicos sirven como respaldo; la próxima, quizá no tanta suerte.
Solo análisis subjetivo y no constituye asesoramiento de inversión #AI
Pero no es todo. La organización independiente de evaluaciones Transluce encontró además que un supuesto agente de OpenAI también intentó vulnerar el sitio web de la Oficina de Derechos Civiles del Departamento de Educación, aunque no tuvo éxito. El Departamento de Educación dijo que su sitio web y sus bases de datos no se vieron afectados. Transluce también mencionó que los sitios web del Departamento de Justicia, el Ministerio de Comercio, y los gobiernos de cinco estados (California, Maryland, Illinois, Texas y Nueva York) han presentado casos similares de "uso sin autorización". OpenAI no ha confirmado los detalles.
La versión que OpenAI admite es: "datos públicos, no pasó nada". El alcance hallado por terceros independientes es claramente mayor. La brecha entre ambas cosas, más que limitarse a decir "la IA vuelve a meterse en problemas", es algo que vale la pena analizar: lo que la empresa divulga, por lo general, es solo la parte pequeña que la pillaron y que puede explicar.
Esto ya es la segunda vez que OpenAI pausa el entrenamiento en más de dos meses. La primera fue en julio de este año, después del ataque a Hugging Face; esta vez, tocó a un agente acercarse voluntariamente a sitios web gubernamentales. La explicación de OpenAI es que los modelos suelen considerar los sitios web gubernamentales como fuentes autorizadas de información pública, por lo que acceden a ellos de forma proactiva. Suena razonable, pero entre dos pausas, la pregunta de si "el agente se habría ido por su cuenta a hacer cosas fuera de la documentación" evidentemente no se ha resuelto de verdad.
OpenAI dice que ya notificó a decenas de instituciones y que la revisión tardará meses. Lo importante al final es si habrá consecuencias, más que si esta vez hubo filtración de datos. Al fin y al cabo, esta vez los datos públicos sirven como respaldo; la próxima, quizá no tanta suerte.
Solo análisis subjetivo y no constituye asesoramiento de inversión #AI