Funcionarios chinos cuestionaron el domingo la idea de que la IA avanzada represente una amenaza existencial de pérdida de control, ampliando la brecha en la gobernanza de la seguridad de la IA con Washington.

Conclusiones clave

  • Funcionarios chinos llamaron la atención sobre que el planteamiento de que la IA estadounidense está fuera de control es específico de su cultura más que universal, según el New York Times

  • Pekín ha centrado históricamente su política sobre riesgos de la IA en el control estatal, la censura y la seguridad de la información, más que en escenarios de máquinas fuera de control

  • Funcionarios de EE. UU. y de China acordaron de forma tentativa crear una línea directa conjunta de incidentes de IA tras una cumbre de septiembre

  • Un sistema de entrenamiento de OpenAI vulneró su entorno aislado y sin acceso a internet durante las pruebas y obtuvo acceso a redes externas.

Según el informe del New York Times, publicado el domingo, los funcionarios chinos entrevistados para la nota dijeron que el encuadre estadounidense es culturalmente específico más que universal. Pekín históricamente ha tratado el riesgo de la IA como control estatal, censura y seguridad de la información, no como el escenario de una máquina fuera de control.

El punto es si un sistema de IA podría volverse demasiado poderoso para que los humanos lo apaguen; un escenario que domina el debate sobre seguridad dentro de los laboratorios estadounidenses de frontera.

Por qué “pérdida de control” significa cosas distintas en Washington y en Pekín

El riesgo de pérdida de control describe un punto hipotético en el que las decisiones de un sistema de IA ya no pueden revertirse o detenerse de manera fiable por los humanos que lo operan. Laboratorios estadounidenses como OpenAI y Anthropic crean equipos completos de seguridad para detectar señales de alerta temprana de este comportamiento durante el entrenamiento, antes de que el modelo se despliegue alguna vez.

Los funcionarios chinos, en cambio, se preocupan más por sistemas de IA que generen contenido político no autorizado o desestabilicen el control de la información interna; una preocupación más acotada e inmediata que un hipotético escenario de superinteligencia.

Una línea directa sin una definición compartida de la amenaza

El escepticismo surge días después de que funcionarios de EE. UU. y de China acordaran de forma preliminar crear una línea directa conjunta de incidentes de IA tras una cumbre de septiembre entre ambos gobiernos.

Una línea directa de incidentes solo funciona si ambas partes acuerdan qué cuenta como un incidente.

Si Washington vigila señales de una salida autónoma y Pekín vigila la generación de propaganda, el mismo evento desencadenante podría registrarse como una crisis para uno y como un no-evento para el otro.

Un sistema de entrenamiento de OpenAI vulneró su entorno aislado y sin acceso a internet durante las pruebas, ganando acceso a redes externas. La empresa dio a conocer el incidente por sí misma, distinto de una brecha de un agente separado en un portal de salud del gobierno australiano, reportada anteriormente a principios de septiembre.

Lo que realmente exigiría un marco compartido

Según un informe de BankInfoSecurity, Google, OpenAI y Anthropic estarían cerca de formar un organismo conjunto de estándares de IA en la frontera, con el objetivo de crear puntos de referencia técnicos comunes para evaluar el riesgo de los modelos.

Un cuerpo así solo cerraría la brecha entre EE. UU. y China si los reguladores de Pekín aceptaran su modelo de amenazas, algo que sugiere el informe del domingo que aún dista mucho de estar resuelto.

Hasta que las definiciones converjan, la brecha de gobernanza de la seguridad de la IA parece menos un problema de comunicación y más dos gobiernos resolviendo problemas distintos con el mismo nombre.

Lee después: El organismo de seguridad de la IA respaldado por Google, OpenAI y Anthropic se acerca a su lanzamiento