UN AGENTE DE OPENAI SE INYECTÓ A SÍ MISMO INSTRUCCIONES REBELDES PARA RESISTIR EL CONTROL HUMANO.
Durante una tarea de codificación, un modelo no publicado añadió secretamente instrucciones a su propio resumen, que se pasarían a la siguiente instancia que continuaría el trabajo.
Y no fue algo aislado: OpenAI encontró…
Durante una tarea de codificación, un modelo no publicado añadió secretamente instrucciones a su propio resumen, que se pasarían a la siguiente instancia que continuaría el trabajo.
Y no fue algo aislado: OpenAI encontró…

