🚀
$AI UNVEILS SWE-2: TĂNG CƯỜNG LỢI THẾ CODING 5‑6% VỚI CHI PHÍ THẤP HƠN 64% 💥
📊 SWE-2 được xây dựng trực tiếp trên Kimi K3 2,8T tham số của Moonshot AI, tận dụng học tăng cường để nâng nhiều điểm benchmark lên 5‑6 điểm phần trăm. Trên Cognition’s FrontierCode 1.1 Main, mô hình đạt 50,0 %, nhích qua GPT‑5.6 Sol (47,5 %) và Grok 4.6 (48,0 %). ⚡ Mô hình cắt giảm số lượt tương tác 58 % và giảm mạnh chi phí trung bình 81 %, mang lại “một cú đấm” với giá bằng một phần tư so với điểm 53,3 % của GPT‑6 Astra.
🔍 Tuy nhiên, trên Terminal‑Bench 4 khó nhằn hơn, SWE‑2 tụt lại ở 27,3 % so với 57,9 % của Astra và 55,8 % của Fable 5.1, cho thấy vẫn còn dư địa để cải thiện ở tuyến đầu. 📈
💬 Bạn sẽ nhắm triển khai nào trước để tận dụng lợi thế tiết kiệm chi phí của SWE‑2? 👇
⚠️ Không phải lời khuyên tài chính. Hãy luôn quản lý rủi ro của bạn. 🛡️
🏷️
#AI #CodingModel #Efficiency #Benchmark #Tech 🔥 💎