أنتروبيك تطلق نموذجًا جديدًا أيضًا
الأكثر إثارة هو جانب الأبحاث. Terminal-Bench-Science: Fable 5 حقق 24.7%، وFable 5.1 وصل مباشرةً إلى 52.6%. أمّا Opus 5 فبنسبة 29.0%، وGPT-5.6 Sol بنسبة 22.4%.
كما أن التحسينات في البرمجة ملحوظة أيضًا. Terminal-Bench 4.0 ارتفع من 42.0% إلى 55.8%، بينما AutomationBench ارتفع من 17.1% إلى 31.4%. إذا نظرنا إلى هذه الأرقام فقط
قدرات النموذج ارتفعت، لكن تكلفة الاستخدام الفعلية في المقابل تنخفض. سعر قراءة الكاش أقل من Fable 5 بنسبة 75%، وتقدّر أنتروبيك أن التكلفة الفعلية لأعباء العمل العادية تنخفض تقريبًا بنسبة 25%.
يمكن استخدام Fable 5.1 الآن. جرّبوا وشاهدوا هل صار أقوى بهذه الدرجة بالفعل
المصدر: https://x.com/i/web/status/2094848581425377479
الأكثر إثارة هو جانب الأبحاث. Terminal-Bench-Science: Fable 5 حقق 24.7%، وFable 5.1 وصل مباشرةً إلى 52.6%. أمّا Opus 5 فبنسبة 29.0%، وGPT-5.6 Sol بنسبة 22.4%.
كما أن التحسينات في البرمجة ملحوظة أيضًا. Terminal-Bench 4.0 ارتفع من 42.0% إلى 55.8%، بينما AutomationBench ارتفع من 17.1% إلى 31.4%. إذا نظرنا إلى هذه الأرقام فقط
قدرات النموذج ارتفعت، لكن تكلفة الاستخدام الفعلية في المقابل تنخفض. سعر قراءة الكاش أقل من Fable 5 بنسبة 75%، وتقدّر أنتروبيك أن التكلفة الفعلية لأعباء العمل العادية تنخفض تقريبًا بنسبة 25%.
يمكن استخدام Fable 5.1 الآن. جرّبوا وشاهدوا هل صار أقوى بهذه الدرجة بالفعل
المصدر: https://x.com/i/web/status/2094848581425377479