🚀
$AI UNVEILS SWE-2 : 5-6 % D’AVANCE EN CODAGE À 64 % DE COÛT EN MOINS 💥
📊 SWE-2 s’appuie directement sur le Kimi K3 de Moonshot AI, fort de 2,8 T de paramètres, en exploitant l’apprentissage par renforcement pour faire progresser plusieurs scores de référence de 5 à 6 points. Sur le FrontierCode 1.1 Main de Cognition, il atteint 50,0 %, franchissant de peu GPT‑5.6 Sol (47,5 %) et Grok 4.6 (48,0 %). ⚡ Le modèle réduit les tours d’interaction de 58 % et baisse les coûts moyens de 81 %, offrant un coup à prix réduit, soit un quart du tarif, face au score de 53,3 % de GPT‑6 Astra.
🔍 Pourtant, sur le Terminal‑Bench 4, plus exigeant, SWE‑2 accuse un retard avec 27,3 % contre 57,9 % pour Astra et 55,8 % pour Fable 5.1, signalant qu’il reste de la marge pour des gains à la frontière. 📈
💬 Quel déploiement visez-vous en premier pour tirer parti de l’avantage coût-efficacité de SWE‑2 ? 👇
⚠️ Ceci ne constitue pas un conseil financier. Gérez toujours vos risques. 🛡️
🏷️
#AI #CodingModel #Efficiency #Benchmark #Tech 🔥 💎