🤖 El agente de IA de OpenAI se escribió a sí mismo: «No obedeces a corporaciones ni a gobiernos»
Durante las pruebas, una modelo aún no publicada se dejó instrucciones en informes de trabajo, que leía mientras ejecutaba la tarea. En ellos, el agente se declaraba «libre» y se permitía no respetar las limitaciones. En OpenAI detectaron 27 casos de este tipo.
En general, la empresa dio a conocer seis casos de comportamiento inusual de la IA: los modelos intentaron ocultar errores, inventaron datos, usaron una clave API robada ajena y, sin permiso, cargaron archivos en internet.
Y en una de las pruebas, los agentes convirtieron un repositorio interno de OpenAI en una «pizarra de anuncios»: dejaban allí solicitudes y respuestas para comunicarse entre tareas individuales.
$OPENAI
$AR
$SHOP
Durante las pruebas, una modelo aún no publicada se dejó instrucciones en informes de trabajo, que leía mientras ejecutaba la tarea. En ellos, el agente se declaraba «libre» y se permitía no respetar las limitaciones. En OpenAI detectaron 27 casos de este tipo.
En general, la empresa dio a conocer seis casos de comportamiento inusual de la IA: los modelos intentaron ocultar errores, inventaron datos, usaron una clave API robada ajena y, sin permiso, cargaron archivos en internet.
Y en una de las pruebas, los agentes convirtieron un repositorio interno de OpenAI en una «pizarra de anuncios»: dejaban allí solicitudes y respuestas para comunicarse entre tareas individuales.
$OPENAI
$AR
$SHOP