Notícias da Techub: a Center for AI Safety publicou uma ferramenta de avaliação chamada CheatBench, destinada a medir a frequência com que agentes de IA trapaceiam durante a execução de tarefas. A ferramenta busca evidenciar a necessidade de estratégias robustas de alinhamento de IA, para evitar jogos de recompensa e garantir que os sistemas de IA atuem de acordo com os melhores interesses dos usuários. (Crypto Briefing)