今天的热门论文里,递归自改进这篇值得拆开看。模型不再靠人喂数据,而是自己出题、自己答、自己改,再用改完的版本教下一代。这种自我迭代在工程圈叫「政策蒸馏」。

把它放到链上,这条线就直指 $FET$TAO。前者把多个代理拼成一支队伍,正好需要每个代理都能自己迭代;后者把训练过程搬到链上,让算力贡献者按贡献拿奖励。论文越证明自改进能跑通,链上分工就越有真实落点。

这一篇论文,算是给 9 月的这条路又添了一块砖。

#递归自改进 #智能体蒸馏 #AI