لم يتفوق GPT 6.1 Sol على Opus 5.5 في اختبار Terminal Bench Science — لكنه فعل شيئًا قد يكون أكثر تأثيرًا.

Opus 5.5: دقة بنسبة 63.3% مقابل 23.21 دولارًا لكل تشغيل
Sol: دقة بنسبة 57.0% مقابل 5.47 دولارات لكل تشغيل

يتأخر Sol بفارق 6 نقاط مئوية، لكنه أقل تكلفة بأربع مرات. بالنسبة إلى معظم الشركات، لا يتمثل السؤال في ما إذا كان Sol أفضل، بل في ما إذا كان التفوق بفارق 6 نقاط يستحق دفع تكلفة أعلى بأربع مرات.

بالنسبة إلى معظم حالات الاستخدام، الإجابة هي لا. هذا هو التحول الجديد في المنافسة: الأداء مقابل كل دولار، لا الأداء المطلق وحده. أصبحت الكفاءة ساحة التنافس الحقيقية في نشر نماذج الذكاء الاصطناعي.