في 6 أكتوبر، دفعت OpenAI 719 ورقة بحثية في مجال الرياضيات من نموذج داخلي غير مُتاح للجمهور إلى GitHub.
قبل أسبوع واحد، طلبت مجموعة الاستشارة التابعة لها من المختبرات التوقف عن اختبار مسائل رياضيات متقدمة على نماذج مملوكة.
أكثر من 600 استجابة من استطلاعات رأي شكّلت إرشادات لجنة معهد الدراسات المتقدمة الصادرة في 29 سبتمبر
تستند مجموعة الاستشارة المعنية بالرياضيات والذكاء الاصطناعي إلى معهد الدراسات المتقدمة في برينستون، نيوجيرسي. وفي 29 سبتمبر، نشرت توصيات مستندة إلى أكثر من 600 استجابة من استطلاعات رأي.
“نريد أن نوضح بوضوح منذ البداية: نحن لا نؤيد هذه الممارسة، ونطلب منهم التوقف عن اختبار المسائل الرياضية المتقدمة على نماذج مملوكة”، كتبت المجموعة.
يُحذّر المستند نفسه من أن النماذج الداخلية الخاصة قد تخلق نظامًا ذا مستويين حيث تتقدم المعامل على بقية المجال.
كجزء من تطوير النموذج، تقول OpenAI في مستودعها إن الشركة تختبر نماذجها على مشكلات بحثية مفتوحة. وقد وسّعت تلك الاختبارات بعد أن تشبعت معاييرها الرياضية الحالية.
قالت OpenAI إنها تشاورت مع المجموعة واستندت إلى توصياتها للإفراج. وفي بيان صدر في 6 أكتوبر، قالت المجموعة إن دورها الاستشاري ليس “تأييدًا لعملية حصول OpenAI على تلك التوصيات”.
سلمت المجموعة الحكم بشأن الامتثال إلى المجتمع الرياضي الأوسع.
يُثبت كود Lean الخاص بـ نافييه-ستوكس ادعاءات أضعف من الورقة المكتوبة
جمّعت OpenAI 719 ورقة ضمن 372 عائلة رياضية، لكل منها نتيجة رئيسية وأدلتها المرتبطة. وقدّمت النموذج المملوك نحو 4,000 مشكلة، واستغرقت كل نتيجة قرابة ثلاث ساعات من حساب تفكير ChatGPT Pro بالمعدل.
طلبت المجموعة من معامل الذكاء الاصطناعي نشر اسم النموذج، والمطالبات، وسلسلة أفكار مختصرة، والوقت المستغرق، وتكلفة الحوسبة لكل نتيجة.
نشرت OpenAI 10 ملخصات للتفكير، ويَحمِل نحو 42% من النتائج الرئيسية صياغات Lean الشكلية.
Lean هي لغة برمجة يمكن استخدامها للتحقق من البرهان بواسطة جهاز كمبيوتر. إذا كان الكود ينجح في الترجمة، فهذا لا يعني أن الكود والحجة المكتوبة متطابقان. بل يعني فقط أن العبارة الصورية صحيحة.
فحص ألكسندر باستونيس وفابيان سيرسيللي وأندرس سي. هانسن هذه الفجوة في ورقة نُشرت في 6 أكتوبر. ووجدوا أن ورقة نافييه-ستوكس المكتوبة من OpenAI تُطلق ادعاءات أقوى مما يثبتُه كود Lean الخاص بها، وتشير إحدى التقديرات إلى أن ترتيب المشتقات الداخلة يتغير.
اكتشف المؤلفون ترجمات خاطئة مماثلة في برهان أويلر الخاص بـ OpenAI. وقالوا إن البرهان المكتوب الخاص بـ OpenAI وبراهين Lean الأخرى التي جرى تأسيسها آليًا “لا ينبغي الوثوق بها مبدئيًا دون عملية مراجعة وتدقيق من قِبل الأقران نفسها التي تخضع لها بقية البراهين”.
أعلنت OpenAI نتيجة نافييه-ستوكس في 8 سبتمبر. ووفقًا لـ Cryptopolitan، تنازع رياضياتي جامعة نيويورك (NYU) تريستان باكمستر لاحقًا مع وصف الحد الأدنى من المدخلات البشرية المتضمنة في العمل.
تعهدت الشركة بتوفير تمويل نقدي لورش عمل ومؤتمرات وبرامج خاصة حول نتائج رئيسية في مجال الذكاء الاصطناعي.
في 6 أكتوبر، كتب تيرينس تاو أن مروّجي الذكاء الاصطناعي غالبًا ما يحلون المشكلات ثم يفقدون الاهتمام بمجالها. وقال إن كثيرين لا يستطيعون الإجابة عن الأسئلة أو إلقاء عروض حول النتيجة. ولم يذكر منشوره OpenAI.
قالت الشركة إن مستشاريها لا يملكون أي رأي بشأن وتيرة أبحاثها، وفقًا لما نقلته Cryptopolitan في سبتمبر.
إذا كنت تقرأ هذا، فأنت متقدم بالفعل. ابقَ على ذلك مع نشرتنا الإخبارية.
