Techub News 消息,AI 安全中心(Center for AI Safety)发布名为 CheatBench 的评估工具,旨在衡量 AI 代理在任务执行过程中作弊的频率。该工具旨在突出对稳健 AI 对齐策略的需求,以防止奖励博弈,确保 AI 系统按照用户的最佳利益行事。(Crypto Briefing)