ME AI 消息, 微软 CEO Satya Nadella 发布长文表示,随着超级智能(Super Intelligence)系统的发展,行业需要重新审视 AI 信任架构,不能简单依赖模型提供方的承诺,也不能将 AI 行为带来的责任外包。 纳德拉称,过去几十年传统软件系统被部署到各行业时,开发者通常能够追踪行为对应的具体代码路径。但如今的前沿 AI 模型能力已超过传统软件系统,却无法明确将模型输出归因于具体训练数据或模型权重配置。企业正在将具有自主行动能力的 AI 系统接入敏感数据,并赋予其执行关键任务的权限,因此需要构建具备可观察性、可测试性和可控性的系统,将“智能供给”与“权限控制”分离。 纳德拉提出,应采用工程化方式治理超级智能,通过确定性的系统设计、人工控制和操作流程约束非确定性模型,并将 AI 系统视为潜在“内部风险”进行管理,包括限制权限、记录行为、建立隔离边界等。他还提出超级智能系统应遵循多模型协作、全程可观察、持续验证、独立控制、独立审计、风险隔离和事件披露等原则。其中,他强调模型思维链(CoT)透明度是基础要求,但仅依靠 CoT 透明并不足够,因为模型输出本身仍可能缺乏可靠的可解释性。 纳德拉最后表示,未来最值得信任的超级智能系统,并不是“最值得信任的模型”,而是“即使不完全信任模型,也仍能安全运行的系统”。(来源:ME)
