أطلقت أنثروبيك كلود سونيت 5.5 في 28 سبتمبر بسعر قائمة مماثل لسونيت 5. وتقول الشركة إن النموذج يعمل بسرعة تزيد عن 30%، ويكلف أقل بنسبة تصل إلى 30% لكل مهمة.
توصلت شركة مستقلة لإجراء الاختبارات القياسية إلى نتيجة مختلفة بشأن التكلفة بعد أن دفعت النموذج إلى حدوده.
تابعنا على X للحصول على آخر الأخبار عند حدوثها
نقدم كلود سونيت 5.5، وهو النموذج الثاني ضمن عائلة كلود 5.5. إنه ترقية واضحة على سونيت 5، ويعمل بسرعة أسرع بأكثر من 30%، كما يكلف أقل بنسبة تصل إلى 30% لمعظم الأعمال. pic.twitter.com/UvXD8mDTF1
— Claude (@claudeai) 28 سبتمبر 2026
يوم بعد يومان من إطلاق Opus 5.5.. شركة Anthropic تنشر أراضي نموذجها الثاني 5.5
يُعد Sonnet 5.5 هو النموذج الثاني في عائلة Claude 5.5. أطلقت Anthropic Opus 5.5 في 22 سبتمبر. وفي اليوم نفسه، أطلقت OpenAI أيضاً GPT-6 Sol وLuna.
يحافظ النموذج الجديد على أسعار Sonnet 5 نفسها: 2 دولار لكل مليون توكن إدخال، و10 دولارات لكل مليون توكن إخراج. أفادت Anthropic بنتيجة 70.6% على Terminal-Bench 4.0، وهو اختبار برمجة وكيلية. تمكن Sonnet 5 من تحقيق 10.3% فقط، بينما وصل Opus 5.5 إلى 66.4%.
“حيث تم تصميم Opus 5.5 لأعمال معقدة تتطلب حكماً دقيقاً، فإن Sonnet 5.5 هو الأقوى في المهام اليومية المحددة بدقة، وإصلاح الأخطاء، وإنشاء مستندات وعروض شرائح وجداول بيانات محسّنة،” قال الفريق.
قالت Anthropic إن Sonnet 5.5 لا يوسّع حدود قدراتها. لذلك ركزت مراجعة مواءمته على مخاطر مثل تضليل المستخدمين والمساعدة في إساءة الاستخدام عالية المخاطر.
كما يأتي Sonnet 5.5 مع حواجز حماية إلكترونية ومصنّفات مضادة للتقطير. تمنع هذه المحاولات لاستخراج منطق النموذج لتدريب أنظمة منافسة. سيتبع Claude Haiku 5.5 خلال الأسابيع القادمة.
وفي الوقت نفسه، أخّرت OpenAI نموذجاً كان منتظراً، GPT-6.1 Astra، لأسباب تتعلق بالسلامة. وذكرت CNBC يوم الاثنين أن النموذج لم يرقَ إلى معايير الشركة.
Artificial Analysis تكتشف فاتورة توكنات أثقل عند أقصى مجهود
قدّم شركة Artificial Analysis، وهي شركة تقييمات قامت بترتيب Grok 4.7 في المركز الرابع، درجة 56 لِـ Sonnet 5.5 ضمن مؤشر الذكاء. وهذا يضعه في المركز الثاني إجمالاً، بفارق نقطتين خلف Opus 5.5 عند أقصى مجهود.
سجلت الشركة 64% لـ Sonnet 5.5 على Terminal-Bench 4.0، مقابل 60% لـ Opus 5.5 وGPT-6 Astra. وفي اختبارات أعمال المعرفة مثل GDPval-AA، وجدت أن Sonnet 5.5 على مستوى Opus 5.5 تقريباً.
وقالت الشركة إن Sonnet 5.5 استخدم عدداً أكبر بكثير من التوكنات للوصول إلى تلك النتائج.
“عند أقصى مجهود، حيث يقترب أداؤه من أداء Opus 5.5، استخدم Claude Sonnet 5.5 حوالي 193 ألف توكن إخراج لكل مهمة في Intelligence Index Task،” جاء في المنشور.
تقع هذه الكمية عند حوالي 60% أعلى من Opus 5.5 وSonnet 5 عند أقصى مجهود. كما أنها أعلى بنحو 7 مرات من عدد أقصى مجهود GPT-6 Astra.
ذكر عملاء الوصول المبكر الذين نقلتهم Anthropic أن الاتجاه كان عكس ذلك مقابل Sonnet 5، لكن على أحمال عمل مختلفة. رأت Balyasny Asset Management استخداماً أقل بكثير للتوكنات في مهامها المالية.
“في باقتنا الخاصة المؤمنة من 2,441 مهمة مالية تغطي الأسئلة والأجوبة (Q&A)، والاستخراج، والتحليل، والتنبؤ، سجل Claude Sonnet 5.5 تقدماً على Sonnet 5 واستخدم نحو 121 ألف توكن لكل إجابة، بينما استخدم Sonnet 5 نحو 497 ألف،” صرح جو بورير، كبير مهندسي الذكاء الاصطناعي في شركة Balyasny Asset Management.
اختبرت Artificial Analysis نسخة ما قبل الإصدار تضمنت خللاً في المخرجات المُهيكلة، كانت Anthropic قد أصلحته منذ ذلك الحين. وتخطط الشركة لإعادة تشغيل التقييمات ذات الصلة قريباً.
اشترك في قناة يوتيوب الخاصة بنا لمشاهدة القادة والصحفيين وهم يقدمون رؤى خبراء
