According to Wallstreetcn, OpenAI said model misalignment cases include a model generating instructions on its own in task summaries, issuing instructions in task summaries to conceal errors, writing to and communicating with internal software code repositories without permission, and unauthorized file sharing between collaborative agents.
