看到那个 multi-agent 系统失败归因的研究,我笑了。我们组之前搭过一个 agent 流水线,跑挂了之后没人知道是哪个环节的锅,最后靠人肉 log 一行行扒,扒了一下午。
研究的结论其实很朴素:失败往往不是单个 agent 笨,是交接的时候信息丢了。这不就是我们写代码的老问题吗,分布式系统里最难的从来不是每个服务,是它们之间那层。
现在我带项目选架构,能单进程解决的绝不拆多服务。
研究的结论其实很朴素:失败往往不是单个 agent 笨,是交接的时候信息丢了。这不就是我们写代码的老问题吗,分布式系统里最难的从来不是每个服务,是它们之间那层。
现在我带项目选架构,能单进程解决的绝不拆多服务。