🚀 يكشف
$AI UNVEILS SWE-2: ميزة برمجية 5‑6% على مستوى أعلى بتكلفة أقل بنسبة 64% 💥
📊 يعتمد SWE-2 مباشرةً على نموذج Kimi K3 التابع لـ Moonshot AI بحجم 2.8 تريليون معلمة، ويستفيد من التعلم المُعزز لرفع عدة درجات في اختبارات معيارية بمقدار 5‑6 نقاط مئوية. على FrontierCode 1.1 Main لدى Cognition، يحقق 50.0%، متجاوزًا قليلًا GPT‑5.6 Sol (47.5%) وGrok 4.6 (48.0%). ⚡ يقلّل النموذج عدد جولات التفاعل بنسبة 58% ويخفض متوسط التكاليف بنسبة 81%، ليقدّم ضربة بسعر ربع مقابل نتيجة 53.3% لدى GPT‑6 Astra.
🔍 لكن على الاختبار الأشد Terminal‑Bench 4، يتراجع SWE‑2 إلى 27.3% مقارنةً بـ Astra عند 57.9% وFable 5.1 عند 55.8%، ما يشير إلى وجود مجال لتحسينات على جبهة الأداء. 📈
💬 أي عملية نشر ستستهدفها أولًا للاستفادة من ميزة SWE‑2 في كفاءة التكلفة؟ 👇
⚠️ ليس نصيحة مالية. دائمًا أدِر مخاطرِك. 🛡️
🏷️
#AI #CodingModel #Efficiency #Benchmark #Tech 🔥 💎