تحدّي نشرة أخبار الذكاء الاصطناعي: أطلقت NaiveAI، التي أسسها الأستاذ المشارك بجامعة تسينغهوا داي جيفينغ، Naive-N0.5-Flash وفتحت أوزان النموذج. تم تكييف النموذج من القاعدة MiMo-V2.5 من Xiaomi، وهو مفتوح المصدر تحت رخصة MIT.احتفظت NaiveAI بالهندسة المعمارية الأصلية لـ MoE وركزت على تعديل آلية الانتباه. قام الفريق باستبدال الانتباه العام بانتباه نافذة منزلقة وبـ DeepSeek sparse attention، ثم واصل التدريب على 3.25 تريليون رمز. يدعم النموذج المعدّل بشكل أصلي سياقًا من مليون رمز، ما يمكن أن يقلل الحمل الحاسوبي عند معالجة النصوص شديدة الطول.كما شاركت AI مباشرة في البحث والتطوير. كانت مسؤولة عن كتابة الكود، وتشغيل التجارب، وتحليل النتائج، والاستمرار في التحسين، بينما وضع الباحثون الاتجاه واتخذوا القرارات الرئيسية. وبالنسبة إلى نظام الاستدلال NaiveRT كمثال، أجرى الفريق 151 جولة من تجارب التحسين خلال 6 أيام، تم اعتماد 63 جولة منها.السرعة القصوى للاستدلال التي أعلنتها الشركة رسميًا هي 2,122 tok/s، لكن ظروف الاختبار كانت خاصة جدًا: باستخدام 8 وحدات معالجة رسومية (GPUs)، مع تعطيل وضع التفكير، واستبعاد وقت معالجة الإدخال، وأخذ أفضل ثانية واحدة من أصل 41 طلبًا. في الوضع القياسي، تبلغ السرعة المذكورة رسميًا حوالي 50 tok/s لكل مستخدم.
