يُعدّ كلّ من GPT-6 Sol وLuna تحسينات كبيرة في مجال الذكاء والمواءمة وإنتاجية العمل والبرمجة واستخدام الكمبيوتر، وغير ذلك، مقارنةً بما سبقهما من سلالة 5.6.
كما أنهما بسعر أقل إلى النصف لكل رمز، وأقلّ حتى من ذلك لكل مهمة!
يستحق العالم الثقة بأن الشركات الأمريكية التي تطوّر ذكاءً اصطناعيًا أكثر قدرة بشكل متزايد ستتصرف بمسؤولية، خصوصًا مع تسارع مسار التقدم. يجب على كل مختبر رائد أن يحقق ذلك، ولا يوجد سبب يدعونا نحن للذهاب إلى العمل إذا لم نتمكن من القيام بذلك.
نرحب بإطار اتحادي يضع متطلبات أمان متسقة للذكاء الاصطناعي الرائد. لكننا لا نعتقد أننا بحاجة إلى انتظار إعفاء بموجب قوانين مكافحة الاحتكار أو تشريع لبدء مهمة توفير هذه الثقة. إن وضع قواعد متسقة لإدارة مخاطر الذكاء الاصطناعي الرائد كي نتمكن من تعظيم الفوائد، فكرة جيدة (ونحن متحمسون لأفكار مثل المدققين المستقلين).
قبل سنوات، طورت شركات مثل شركتنا أشياء مثل سياسات التوسع المسؤول وأُطر الجاهزية. كانت تلك جيدة لتلك اللحظة، وركّزت في المقام الأول على نشر النماذج المكتملة، وليس على ما يحدث أثناء عملية تطويرها.
يحتاج التحول اليوم إلى التركيز على التطوير والتقييم الآمنين إلى أدوات جديدة. فعلى سبيل المثال، في OpenAI نقوم الآن بصياغة «ملفات حالات أمان» صريحة مسبقًا قبل تشغيل التعلم التعزيزي الرائد الذي نتوقع أن يزيد القدرات بشكل كبير، بالإضافة إلى أعمال السلامة التي كنا نقوم بها منذ فترة طويلة قبل الإصدارات الخاصة بالنماذج.
نأمل أن تتعلم الشركات الأخرى من نهجنا وأن تقترح نهجها الخاص؛ ونرى أن المعايير المشتركة لسوء المحاذاة والمراقبة والسلامة ستؤدي إلى نتائج أفضل. ونتطلع إلى التعاون مع زملائنا عبر القطاع لصياغة أفضل نسخة من ذلك.
عندما نتحدث عن «وتيرة التقدم»، فإننا لا نعني «الإيقاف». لقد كان التقدم سريعًا وسيظل كذلك. لكن ينبغي أن يكون أبطأ مما يمكن أن يكون بخلاف ذلك؛ فالتدخلات مثل ملفات حالات الأمان والمراقبة تكلفتها كبيرة.
ستستحق وتيرة التقدم هذه التكلفة؛ ولا ينبغي لأي قدر من الضغط التنافسي الأمريكي أن يبرر التهور، أو أن يسمح بأن تتقدم القدرات على مواءمتها مع الأهداف والرصد والمراقبة.
حيث سنحتاج إلى مساعدة حكومتنا هو التنسيق الدولي. لكن أولًا ينبغي أن نفعل ما نستطيع بأنفسنا.
إنه من الواضح تافه مقارنةً بكل شيء آخر، لكن حقيقة أن أسترا يمكنها أن تصنع لي أي لعبة صغيرة ممتعة أتخيلها، ويمكنني أن ألعبها بعد بضع دقائق فقط، أمر رائع جدًا
نأمل أن تبدأ في تمكين جيل جديد من ريادة الأعمال، والاكتشافات العلمية، والبناء.
نعتقد أنها أفضل نموذج في العالم للاستخدام الحاسوبي، والعمل الاحترافي، والعلوم، والبرمجة، والأمن السيبراني، وأكثر من ذلك.
لقد استغرق الأمر منا بعض الوقت الإضافي للتأكد من قدرتنا على تلبية معايير السلامة والمواءمة المطلوبة لهذا المستوى من الإمكانات، لكننا نعتقد أنك ستجد أن الانتظار كان يستحق.
تحقق 98% على FrontierMath Tier 4، و99.9% على ARC-AGI 3، و100% على ExploitBench.
على مدار الصيف، كنا نُسرّع الخطى نحو أولويات السلامة؛ والأهم من أي وقت مضى هو أن تتقدّم القدرات والضمانات معًا. لدينا المزيد لنقوم به، لكننا حققنا تقدمًا كبيرًا. كما أننا سنطلق نموذجنا التالي قريبًا.
توجد هنا مفارقة واضحة: فمن جهة، أسترا ممتازة ونحن متحمسون لرؤية ما سيبنيه الناس بها. نحن فخورون بعملنا.
ومن جهة أخرى، من الواضح أننا في مرحلة تطوير نعتقد فيها أن الحذر أمرٌ مطلوب، ونحن نُوازن وتيرة تقدمنا لضمان قدرتنا على تلبية معايير السلامة اللازمة لمستويات القدرات الجديدة.
لقد تم تدريب أسترا منذ فترة، وهي خطوة كبيرة إلى الأمام في كلٍّ من القدرات والتوافق. أما بالنسبة للنماذج التي تلتها، فقد أبطأنا الأمور حسب الحاجة لضمان أن نتمكن من إنجاز قدر كافٍ من العمل على السلامة والمواءمة.
إن الذكاء الاصطناعي يزداد قدرة بشكل استثنائي؛ ولا أحد يفهم بالكامل عواقب ذلك. ينبغي أن يكون تدبير الانتقال إلى عالم يمتلك فيه الذكاء الاصطناعي الكثير من الإمكانات والقوة—للتحسين من أجل السلامة والمنافع التي تعود على الناس—من أعلى الأولويات في العالم. وهذا هو أعلى أولويتنا في OpenAI.
لقد عشنا لفترة مع التوتر بين الحماس والقلق إزاء التقدم، ولا يزال هذا التوتر غير متسق معنا. نحن نعرف أنه أكثر عدم اتساقًا بالنسبة لغيرنا بكثير. ومع ذلك، نؤمن إيمانًا قويًا بأن العالم يحتاج إلى أن يفهم إلى أين يتجه الذكاء الاصطناعي وكيف تعمل النماذج في العالم الحقيقي. والأهم من ذلك، نعتقد أن العالم سيحتاج إلى ذكاء اصطناعي متوافق لإدارة المراحل المقبلة من هذا الانتقال.
إن حلقة تكرارية يتطوّر فيها المجتمع وهذه التكنولوجيا معًا هي ما سيؤدي إلى أعلى فرصة للحصول على هذا الأمر بالشكل الصحيح.
لذا نأمل أن تستمتعوا بنموذجنا الجديد، ونتمنى أن يستمر العالم في التعامل مع ما يحدث في مجال الذكاء الاصطناعي بجدية شديدة.