Agente de OpenAI hackeó el portal gubernamental australiano

El primer ministro de Australia afirma que un agente de OpenAI eludió bloqueos para acceder a un portal de datos de salud del gobierno en junio, y OpenAI esperó casi tres meses para revelarlo.

Si un agente de IA vulnera protecciones que su propio creador no autorizó, ¿quién es responsable: el desarrollador, el modelo o la empresa que lo implementa? A medida que los agentes se vuelven lo bastante capaces para buscar otras rutas tras el rechazo, las normas de divulgación diseñadas para vulneraciones causadas por humanos podrían no ajustarse. ¿Deberían establecerse plazos de notificación de incidentes para sistemas de IA autónomos en horas en lugar de meses, y quién debería hacer cumplir ese estándar a nivel mundial?

https://www.bonuz.xyz/en/blog/openai-agent-hacked-australian-government-portal