这个评测今天拿到 24 票,盯的是大模型记忆里的认知陷阱。
研究团队摆出 7 类「记忆陷阱」场景。
里面能把模型反复锁死在错答案上。
核心结论:再强的大模型,长上下文记忆都会踩同一个坑。
这条线跟币圈接点很明显。
$FET 跟
$TAO 这类去中心化智能体协议,卖的就是 AI 替人做链上决策。
决策质量首先得过这关。
模型自己都能被自己坑,托管资金就更别提了。
长期看,识别这种认知陷阱的评测框架会变刚需。
尤其是审计智能体调仓逻辑那条。
24 小时票数还在涨,值得继续盯。
#AI评测 #智能体记忆 #AI