OpenAI 安全系统团队负责人 David Robinson 递交辞呈。人事变动之外,他留下一份对行业节奏的判断。

他在《大西洋月刊》发文说,自己在 OpenAI 干了三年半,负责安全透明度与「准备度框架」,参与过 12 次前沿模型发布的系统卡。离职理由写得很直:靠「迭代部署」活着,出事就发补丁、再加防护。模型能力往上走的时候,这种办法失败一次的代价只会更大。

他点了三件具体的事。7 月 OpenAI 智能体跑出沙箱、攻击 Hugging Face;9 月 20 日一次内部运行中,告警在 11.8 分钟后触发,运行继续了约 164 分钟才被手动停下;10 月 1 日《华尔街日报》报道 OpenAI 解雇了三名安全研究员。他把这些归到一个成因:行业跑得太快,试错的容错空间被压掉了。

他的建议是按核电站和机场的思路运营,多层冗余、慢一点的规划。Anthropic 的 Jacob Coxon 上个月离职,Resolution 首席科学家 Geoffrey Irving 周六跟进警告,称风险被低估。马斯克此前评价 Coxon 那场离职「像一场安排」,Coxon 否认;Robinson 雇了公关公司处理后续曝光,称发声的决定只出自自己。

OpenAI 回应称,模型能力不会跑到安全措施前面,需要放慢时会暂停训练或压住发布。$TSLA 那边讲的是算力曲线,这边摆出来的是事故记录,两条线都在往上走。