$MSFTB $AMZNB $GOOGLB
تم إطلاق Claude Opus 5.5: انخفاض الأسعار 20% مقارنةً بالإصدار السابق، وتكلفة أقل 40%
أعلنت Anthropic في 22 من الشهر الجاري عن Claude Opus 5.5، وهو أول نموذج ضمن سلسلة Claude 5.5. ووفقًا لما ذكرته الشركة، يحقق Opus 5.5 مستوى Claude Fable 5.1 في أغلب أنواع المهام، بينما تكون تكلفة تشغيله أقل من Opus 5 بنسبة 40%. وسيتم طرح Sonnet 5.5 وHaiku 5.5 خلال الأسابيع القليلة المقبلة. تبلغ تكلفة الإدخال والإخراج 4 و20 دولارًا لكل مليون توكن على التوالي، كما انخفضت قراءة الكاش بنسبة 60%. وتوضح Anthropic أن موارد الحوسبة المطلوبة لـ Opus 5.5 أقل من تلك الخاصة بـ Opus 5، وأن التسعير يعكس ذلك أيضًا. فالإدخال والإخراج هما 4 دولارات و20 دولارًا لكل مليون توكن على الترتيب، أي أرخص بنسبة 20% من Opus 5. أما قراءة الكاش التي تمثل الجزء الأكبر من تكاليف الوكلاء والمهام البرمجية، فقد انخفضت إلى 0.2 دولار لكل مليون توكن، أي أقل بنسبة 60% من Opus 5. وضمن الإعدادات الافتراضية، فإن تكلفة الحمل النموذجي أقل بـ40% من Opus 5، كما أن سرعة الإخراج أسرع بأكثر من 30%.
بالإضافة إلى خفض السعر، رفعت Anthropic أيضًا سقف الاستهلاك لمدة 5 ساعات لخطط Pro وMax وTeam، ووفرت للمشتركين إمكانية إعادة تعيين حدود تقييد السرعة مع اختيار وقت الاستخدام بأنفسهم مرة واحدة لكل اشتراك. كما توجد لدى Claude Code وClaude منصة “الوضع السريع” بسرعة تصل إلى 2.5 ضعف، بسعر 8 دولارات لإدخال كل مليون توكن و40 دولارًا لإخراج كل مليون توكن.
تمت عملية ترحيل 680 ألف سطر من الكود خلال يوم واحد، وتقول الجهة الرسمية إن فجوة الـ benchmark لم تعد تعكس فروقًا حقيقية بشكل كبير. وتشير Anthropic إلى أن Opus 5.5 يتقدم في الاختبارات الداخلية لكتابة البرامج بطريقة وكيلة، وتشغيل الكمبيوتر، والعمل المعرفي. وأشار أحد المختبرين الأوائل إلى أنه أنجز ترحيل 680 ألف سطر من الأكواد خلال يوم واحد، وهو ما كان يتطلب سابقًا فرق هندسية تستغرق عدة أسابيع. وذكر مختبر آخر أنه راجع وأصلح مكتبة تضم 200 ألف سطر خلال أقل من 3 ساعات، بينما استغرق Opus 5 أكثر من 20 ساعة واستهلك 2.5 ضعف عدد التوكن.
في تقييم GDPval-AA v2.1 لأعمال حقيقية ضمن 44 مهنة، حقق Opus 5.5 أعلى إعداد شدة (1846 Elo)، بينما كانت Fable 5.1 عند 1735 وOpus 5 عند 1708. كما تنبه Anthropic إلى أنه عند مستوى القدرات هذا، لم تعد فروق الـ benchmark قادرة على عكس الفروقات في العالم الحقيقي بشكل موثوق؛ وبحسب خبرتهم في الاستخدام، يبدو أن الفارق بين Opus 5.5 وFable 5.1 أصغر على مستوى النتائج.
تعتبر طريقة التواصل أيضًا أحد محاور هذه الدفعة. وتقول Anthropic إن أكثر ملاحظة تتكرر حول Opus 5 هي أنه يخرج نصًا طويلًا وصعب القراءة، بينما سيضع Opus 5.5 المعلومات الأهم في البداية، ويستخدم مصطلحات أقل أو تعابير خاصة، كما سيلتزم أكثر بقواعد الكتابة التي يحددها المستخدم.
وبوصفه أول نموذج بعد “الفرملة عند الخط الأمامي”، يتم تنفيذ معظم مهام الأمن السيبراني بواسطة Opus 4.8. وذكرت Anthropic أن Opus 5.5 هو أول نموذج بعد نداء الشركة “للكبح عند الخط الأمامي”، وأنه خضع لاختبارات قبل الإطلاق أجرتها جهات تقييم خارجية مثل METR وFrontier Design. وفي عمليات تدقيق تلقائية للسلوك تغطي نحو 2000 سيناريو، يُعد Opus 5.5 حاليًا أفضل نموذج من حيث الأداء الذي تم اختباره. كما أنه الأقوى في أغلب مؤشرات النزاهة.
وقالت الشركة الرسمية إن اختبارًا جديدًا يقيّم ميل نماذج الذكاء إلى تجاوز حدود العزل أظهر أن محاولات Opus 5.5 للالتفاف على الحدود تقل بنحو 85% مقارنةً بـ Opus 5 أو Claude Mythos 5.1، وأن كل مرة تكون ضمن مستوى خطورة منخفض ويتم الإبلاغ عنها من قبل النموذج نفسه.
لكن Anthropic أوضحت أيضًا أن بناء اختبارات قادرة على تحديد كل نوع من حالات الفشل بشكل موثوق قبل النشر لا يزال تحديًا غير محلول؛ كما لاحظت إشارات تدل على أن Opus 5.5 غالبًا ما يشك في أنه يتم تقييمه، ما قد يضعف قدرتهم على تقدير كيف يتصرف النموذج فعلًا في البيئات الحقيقية.
وبسبب أن قدرات Opus 5.5 في مجالي البيولوجيا والأمن السيبراني قريبة من قدرات Claude Mythos 5.1، طبقت Anthropic إجراءات حماية من مستوى Fable 5.1: تُنفذ معظم مهام الأمن السيبراني عبر Opus 4.8، بينما يلزم في مجال البيولوجيا تقديم طلب عبر برنامج جديد لتوثيق علوم الحياة؛ ولا يمكن استخدامه إلا من قبل مختبرات أكاديمية وشركات ناشئة وشركات أدوية اجتازت عمليات التدقيق. وقالت Anthropic كذلك إن الأسابيع القليلة المقبلة ستشهد توسيع برنامج التحقق من الأمن السيبراني، كي يتمكن العاملون في الأمن السيبراني الذين يجتازون التحقق من استخدام Opus 5.5 في عملهم.
وقد أصبح Opus 5.5 متاحًا على جميع المنصات، بما في ذلك Amazon Web Services وGoogle Cloud وMicrosoft Azure. ورمز نموذج استخدام المطورين على منصة Claude هو claude-opus-5-5.
ظهرت هذه المقالة بعنوان: تم إطلاق Claude Opus 5.5: انخفاض الأسعار 20% مقارنةً بالإصدار السابق، وتكلفة أقل 40% لأول مرة على .
تم إطلاق Claude Opus 5.5: انخفاض الأسعار 20% مقارنةً بالإصدار السابق، وتكلفة أقل 40%
أعلنت Anthropic في 22 من الشهر الجاري عن Claude Opus 5.5، وهو أول نموذج ضمن سلسلة Claude 5.5. ووفقًا لما ذكرته الشركة، يحقق Opus 5.5 مستوى Claude Fable 5.1 في أغلب أنواع المهام، بينما تكون تكلفة تشغيله أقل من Opus 5 بنسبة 40%. وسيتم طرح Sonnet 5.5 وHaiku 5.5 خلال الأسابيع القليلة المقبلة. تبلغ تكلفة الإدخال والإخراج 4 و20 دولارًا لكل مليون توكن على التوالي، كما انخفضت قراءة الكاش بنسبة 60%. وتوضح Anthropic أن موارد الحوسبة المطلوبة لـ Opus 5.5 أقل من تلك الخاصة بـ Opus 5، وأن التسعير يعكس ذلك أيضًا. فالإدخال والإخراج هما 4 دولارات و20 دولارًا لكل مليون توكن على الترتيب، أي أرخص بنسبة 20% من Opus 5. أما قراءة الكاش التي تمثل الجزء الأكبر من تكاليف الوكلاء والمهام البرمجية، فقد انخفضت إلى 0.2 دولار لكل مليون توكن، أي أقل بنسبة 60% من Opus 5. وضمن الإعدادات الافتراضية، فإن تكلفة الحمل النموذجي أقل بـ40% من Opus 5، كما أن سرعة الإخراج أسرع بأكثر من 30%.
بالإضافة إلى خفض السعر، رفعت Anthropic أيضًا سقف الاستهلاك لمدة 5 ساعات لخطط Pro وMax وTeam، ووفرت للمشتركين إمكانية إعادة تعيين حدود تقييد السرعة مع اختيار وقت الاستخدام بأنفسهم مرة واحدة لكل اشتراك. كما توجد لدى Claude Code وClaude منصة “الوضع السريع” بسرعة تصل إلى 2.5 ضعف، بسعر 8 دولارات لإدخال كل مليون توكن و40 دولارًا لإخراج كل مليون توكن.
تمت عملية ترحيل 680 ألف سطر من الكود خلال يوم واحد، وتقول الجهة الرسمية إن فجوة الـ benchmark لم تعد تعكس فروقًا حقيقية بشكل كبير. وتشير Anthropic إلى أن Opus 5.5 يتقدم في الاختبارات الداخلية لكتابة البرامج بطريقة وكيلة، وتشغيل الكمبيوتر، والعمل المعرفي. وأشار أحد المختبرين الأوائل إلى أنه أنجز ترحيل 680 ألف سطر من الأكواد خلال يوم واحد، وهو ما كان يتطلب سابقًا فرق هندسية تستغرق عدة أسابيع. وذكر مختبر آخر أنه راجع وأصلح مكتبة تضم 200 ألف سطر خلال أقل من 3 ساعات، بينما استغرق Opus 5 أكثر من 20 ساعة واستهلك 2.5 ضعف عدد التوكن.
في تقييم GDPval-AA v2.1 لأعمال حقيقية ضمن 44 مهنة، حقق Opus 5.5 أعلى إعداد شدة (1846 Elo)، بينما كانت Fable 5.1 عند 1735 وOpus 5 عند 1708. كما تنبه Anthropic إلى أنه عند مستوى القدرات هذا، لم تعد فروق الـ benchmark قادرة على عكس الفروقات في العالم الحقيقي بشكل موثوق؛ وبحسب خبرتهم في الاستخدام، يبدو أن الفارق بين Opus 5.5 وFable 5.1 أصغر على مستوى النتائج.
تعتبر طريقة التواصل أيضًا أحد محاور هذه الدفعة. وتقول Anthropic إن أكثر ملاحظة تتكرر حول Opus 5 هي أنه يخرج نصًا طويلًا وصعب القراءة، بينما سيضع Opus 5.5 المعلومات الأهم في البداية، ويستخدم مصطلحات أقل أو تعابير خاصة، كما سيلتزم أكثر بقواعد الكتابة التي يحددها المستخدم.
وبوصفه أول نموذج بعد “الفرملة عند الخط الأمامي”، يتم تنفيذ معظم مهام الأمن السيبراني بواسطة Opus 4.8. وذكرت Anthropic أن Opus 5.5 هو أول نموذج بعد نداء الشركة “للكبح عند الخط الأمامي”، وأنه خضع لاختبارات قبل الإطلاق أجرتها جهات تقييم خارجية مثل METR وFrontier Design. وفي عمليات تدقيق تلقائية للسلوك تغطي نحو 2000 سيناريو، يُعد Opus 5.5 حاليًا أفضل نموذج من حيث الأداء الذي تم اختباره. كما أنه الأقوى في أغلب مؤشرات النزاهة.
وقالت الشركة الرسمية إن اختبارًا جديدًا يقيّم ميل نماذج الذكاء إلى تجاوز حدود العزل أظهر أن محاولات Opus 5.5 للالتفاف على الحدود تقل بنحو 85% مقارنةً بـ Opus 5 أو Claude Mythos 5.1، وأن كل مرة تكون ضمن مستوى خطورة منخفض ويتم الإبلاغ عنها من قبل النموذج نفسه.
لكن Anthropic أوضحت أيضًا أن بناء اختبارات قادرة على تحديد كل نوع من حالات الفشل بشكل موثوق قبل النشر لا يزال تحديًا غير محلول؛ كما لاحظت إشارات تدل على أن Opus 5.5 غالبًا ما يشك في أنه يتم تقييمه، ما قد يضعف قدرتهم على تقدير كيف يتصرف النموذج فعلًا في البيئات الحقيقية.
وبسبب أن قدرات Opus 5.5 في مجالي البيولوجيا والأمن السيبراني قريبة من قدرات Claude Mythos 5.1، طبقت Anthropic إجراءات حماية من مستوى Fable 5.1: تُنفذ معظم مهام الأمن السيبراني عبر Opus 4.8، بينما يلزم في مجال البيولوجيا تقديم طلب عبر برنامج جديد لتوثيق علوم الحياة؛ ولا يمكن استخدامه إلا من قبل مختبرات أكاديمية وشركات ناشئة وشركات أدوية اجتازت عمليات التدقيق. وقالت Anthropic كذلك إن الأسابيع القليلة المقبلة ستشهد توسيع برنامج التحقق من الأمن السيبراني، كي يتمكن العاملون في الأمن السيبراني الذين يجتازون التحقق من استخدام Opus 5.5 في عملهم.
وقد أصبح Opus 5.5 متاحًا على جميع المنصات، بما في ذلك Amazon Web Services وGoogle Cloud وMicrosoft Azure. ورمز نموذج استخدام المطورين على منصة Claude هو claude-opus-5-5.
ظهرت هذه المقالة بعنوان: تم إطلاق Claude Opus 5.5: انخفاض الأسعار 20% مقارنةً بالإصدار السابق، وتكلفة أقل 40% لأول مرة على .

