Anthropic又出来整活儿了。
公开披露Claude被用于网络攻击、武器研究、监控等案例,并强调自己在持续封堵这些滥用。
出发点当然是AI的安全问题,但这件事也说明AI已经不只是聊天机器人了。
AI开始自己读信息、写代码、调用工具,甚至进入真实经济活动,那新的问题就来了,怎么证明AI是真的变强了?
毕竟豆包现在还经常胡说八道。
那让AI操控Web3钱包,就更需要大家重视。
让AI总结写复盘其实很容易,亏了钱,它可以告诉你哪里出了问题,下一次应该怎么改。
但是打磨进化的路程应该是:做决定 → 看结果 → 找原因 → 修改 → 再测试。
NeoSoul 最近上线的这个NeoTrade自我演进功能,我之前聊过一次。
它把交易当成 AI 的“现实考试”,预测的对不对、交易有没有成交、手续费和滑点多少,最后赚没赚钱,全都会留下真实结果。
甚至改完以后,也可以先用shadow run在真实市场里测试,不急着拿真金白银试错。
所以未来评价一个Agent,可能不能只看它现在有多聪明。
还要看它犯过什么错,以及犯错以后,真的有没有变聪明。
这可能才是AI从“工具”走向“经济参与者”之后,最有意义的进步。
公开披露Claude被用于网络攻击、武器研究、监控等案例,并强调自己在持续封堵这些滥用。
出发点当然是AI的安全问题,但这件事也说明AI已经不只是聊天机器人了。
AI开始自己读信息、写代码、调用工具,甚至进入真实经济活动,那新的问题就来了,怎么证明AI是真的变强了?
毕竟豆包现在还经常胡说八道。
那让AI操控Web3钱包,就更需要大家重视。
让AI总结写复盘其实很容易,亏了钱,它可以告诉你哪里出了问题,下一次应该怎么改。
但是打磨进化的路程应该是:做决定 → 看结果 → 找原因 → 修改 → 再测试。
NeoSoul 最近上线的这个NeoTrade自我演进功能,我之前聊过一次。
它把交易当成 AI 的“现实考试”,预测的对不对、交易有没有成交、手续费和滑点多少,最后赚没赚钱,全都会留下真实结果。
甚至改完以后,也可以先用shadow run在真实市场里测试,不急着拿真金白银试错。
所以未来评价一个Agent,可能不能只看它现在有多聪明。
还要看它犯过什么错,以及犯错以后,真的有没有变聪明。
这可能才是AI从“工具”走向“经济参与者”之后,最有意义的进步。