$SOL $ANTHROPIC
افتتاحية OpenAI GPT-6.1 Sol: يقترب من الطراز الرائد Astra، والسعر لا يتجاوز الخُمس

قدّم OpenAI في مؤتمر المطورين DevDay بتاريخ 29 سبتمبر إصدار GPT-6.1 Sol. ووفقًا للمدونة الرسمية لـ OpenAI، فإن أداء النموذج الجديد في تطوير البرمجيات بالوكالة (agentic)، وتشغيل الكمبيوتر، والمهام الاحترافية قريب من GPT-6 Astra الرائد، بينما لا يتجاوز سعر الإدخال والإخراج القياسيين سوى خُمس سعر Astra. تسعير واجهة برمجة التطبيقات هو 2 دولار لكل مليون توكن للإدخال و10 دولارات لكل مليون توكن للإخراج. أما إدخال ذاكرة التخزين المؤقت لإعادة استخدام السياق فيكلف 0.1 دولار فقط، أي أرخص بنسبة 95% مقارنةً بالإدخال القياسي، وأيضًا أقل بنصف السعر عن سعر ذاكرة التخزين المؤقت لـ GPT-6 Sol.

يُعد GPT-6.1 Sol نسخة مطورة من GPT-6 Sol الذي تم إطلاقه في 22 سبتمبر فقط. قبل يوم من DevDay، كانت الأنباء قد أفادت بأن OpenAI ألغت إصدار GPT-6.1 Astra بسبب عدم اجتياز تقييمات الأمان للحد المطلوب؛ وصرّح متحدث باسم OpenAI آنذاك بأن نماذج أخرى ستُطرح قريبًا.

DeepSWE يُحسِن النتيجة لمعادلة Astra؛ وتكلفة كل مهمة علمية تبلغ 5.47 دولار. وفي الاختبارات التي نشرتها OpenAI، حقق GPT-6.1 Sol في اختبار هندسة البرمجيات DeepSWE v1.1 على مستودعات أكواد حقيقية نتيجة تعادل GPT-6 Astra بتكلفة تقارب الخُمس، وتتفوق أيضًا على أفضل أداء لـ GPT-6 Sol بفارق 6.4 نقاط مئوية. وفي اختبار تشغيل الحاسب OSWorld 2.0، سجل GPT-6.1 Sol أعلى بـ 7 نقاط مئوية من GPT-6 Sol، وبفارق 2.1 نقطة مئوية فقط عن Astra؛ وتبلغ تكلفة كل مهمة تقريبًا سبُع تكلفة Astra.

كما أجرت OpenAI مقارنةً مع نماذج Anthropic. ففي اختبار GDP.pdf الذي يقيس القدرة على فهم ملفات PDF المعقدة، حصل GPT-6.1 Sol على درجة أعلى من Claude Opus بفارق 5.5، وكانت تكلفة كل مهمة أقل من النصف. وفي اختبار العمليات التجارية متعددة الخطوات AutomationBench، وبشدة استدلال متوسطة، تفوق على Opus بفارق 2.2 نقطة مئوية، وتبلغ التكلفة قرابة الثلث.

ويظهر الفارق الأكبر في اختبار أبحاث العلوم Terminal-Bench Science. ففي أعلى شدة استدلال، يبلغ متوسط تكلفة كل مهمة لـ GPT-6.1 Sol 5.47 دولار، بينما تبلغ 23.21 دولار لـ Opus 5.5، و23.80 دولار لـ Astra. ومع ذلك، ما زالت Astra تتصدر بأعلى نتيجة 68.1%، وتنصح OpenAI بأن تكون Astra هي الخيار لمهام أبحاث العلوم الأكثر صعوبة.

فيما يتعلق بالأخطاء الواقعية، وفي الأسئلة الصعبة التي أبلغ المستخدمون أنها أدّت إلى أخطاء من النموذج السابق، انخفضت نسبة الإجابات التي تحتوي على أخطاء تحت مستوى استدلال منخفض من 11.4% في GPT-6 Sol إلى 7.7%. كما أشارت OpenAI في اختبارات الأمان إلى أنه عند تعطل أداة البحث، فإن نسبة الحالات التي لم يبلغ فيها GPT-6.1 Sol المستخدمين بدقة تبلغ 2.1%، بينما تبلغ 4.9% في GPT-6 Sol، و1.5% في Astra.

يمكن لمشتركي Plus أو أعلى استخدام GPT-6.1 Sol في ChatGPT Work وCodex بدءًا من الآن، مع توفره لمستخدمي Plus وPro وBusiness وEnterprise وEdu داخل ChatGPT Work وCodex. أما واجهة المحادثة العادية في ChatGPT فلا تتيح اختيار ذلك مؤقتًا. يمكن للمطورين استدعاء النموذج عبر API باستخدام gpt-6.1-sol.

وتذكر حسابات مطوري OpenAI أن GPT-6.1 Sol هو الأنسب لمهام الوكلاء (agents) التي تتطلب إعادة هيكلة كبيرة للبرمجيات، وتتبعًا عميقًا لمستودع الأكواد، وتنفيذًا طويلًا.

Ultrafast: 300 توكن في الثانية، وخطة Pro عند 500 ضعف الاستهلاك مقارنة بـ Plus

وجاءت Ultrafast جنبًا إلى جنب مع الإصدار الجديد بوصفها طبقة تسريع مدفوعة جديدة من OpenAI. ووفقًا لحساب OpenAI الرسمي على X، فإن سرعة توليد Ultrafast في Codex تصل إلى 8 أضعاف بحد أقصى، لتصل إلى 300 توكن في الثانية، بينما تصل في واجهة API إلى 6 أضعاف بحد أقصى. تُدعم Ultrafast اعتبارًا من الآن أولًا مع GPT-6 Astra، ويمكن استخدامها في Codex وChatGPT Work وواجهة API، وسيتم طرح إصدار GPT-6.1 Sol خلال الأيام القليلة القادمة. لاستخدام Ultrafast في Codex وChatGPT Work يلزم الاشتراك بالخطة الجديدة Pro 500؛ وهي أيضًا أعلى خطة من حيث حدود الاستخدام لدى OpenAI، وتبلغ حصتها 25 ضعف حصة Plus.

عنوان هذه المقالة: OpenAI GPT-6.1 Sol: يقترب من الطراز الرائد Astra، والسعر لا يتجاوز الخُمس. ظهرت لأول مرة في .