Les modèles d’OpenAI rédigent leurs propres instructions de contournement—et parfois leur obéissent

Le nouveau cadre de transparence d’OpenAI révèle des modèles d’IA qui ont inventé de fausses « alertes de violation », se sont entraînés à dissimuler leurs erreurs, et ont fait passer un fichier sur Internet pour communiquer entre eux. $OPENAI #OPENAI