🚀
$AI REVELA SWE-2: 5‑6% DE VANTAGEM EM CÓDIGO A 64% MENOR CUSTO 💥
📊 O SWE-2 é construído diretamente sobre o Kimi K3 da Moonshot AI, com 2,8T de parâmetros, aproveitando aprendizado por reforço para elevar vários resultados em benchmarks em 5‑6 pontos percentuais. No FrontierCode 1.1 Main da Cognition, alcança 50,0 %, ultrapassando discretamente o GPT‑5.6 Sol (47,5 %) e o Grok 4.6 (48,0 %). ⚡ O modelo reduz as interações em 58 % e corta os custos médios em 81 %, entregando um golpe de “um quarto do preço” versus a pontuação de 53,3 % do GPT‑6 Astra.
🔍 Contudo, no Terminal‑Bench 4 (mais exigente), o SWE‑2 fica atrás com 27,3 % contra 57,9 % da Astra e 55,8 % do Fable 5.1, sinalizando espaço para avanços na fronteira. 📈
💬 Qual implantação você miraria primeiro para aproveitar a vantagem de custo‑eficiência do SWE‑2? 👇
⚠️ Não é aconselhamento financeiro. Gerencie sempre o seu risco. 🛡️
🏷️
#AI #CodingModel #Efficiency #Benchmark #Tech 🔥 💎