🚀
$AI MEMBUKA SWE-2: 5‑6% CODING EDGE DENGAN BIAYA 64% LEBIH RENDAH 💥
📊 SWE-2 dibangun langsung di atas Kimi K3 berparameter 2,8T milik Moonshot AI, dengan memanfaatkan reinforced learning untuk meningkatkan beberapa skor benchmark sebesar 5–6 poin persentase. Pada Cognition’s FrontierCode 1.1 Main, model ini mencapai 50,0 %, sedikit melampaui GPT‑5.6 Sol (47,5 %) dan Grok 4.6 (48,0 %). ⚡ Model ini memangkas jumlah turn interaksi sebesar 58 % dan menurunkan biaya rata-rata sebesar 81 %, memberikan pukulan harga seperempat dibanding skor 53,3 % GPT‑6 Astra.
🔍 Namun pada Terminal‑Bench 4 yang lebih menantang, SWE‑2 tertinggal di 27,3 % dibanding Astra 57,9 % dan Fable 5.1 55,8 %, menandakan masih ada ruang untuk peningkatan di frontier. 📈
💬 Penempatan (deployment) yang mana yang ingin Anda targetkan lebih dulu untuk memanfaatkan keunggulan efisiensi biaya SWE‑2? 👇
⚠️ Bukan nasihat keuangan. Selalu kelola risiko Anda. 🛡️
🏷️
#AI #CodingModel #Efficiency #Benchmark #Tech 🔥 💎