في الآونة الأخيرة، تصدّر وكيل مهمة مساعد ون فين من بايدو (Orion Mission Mode) قائمة تقييم عالمية لعملاء الذكاء الاصطناعي بتسجيله نسبة نجاح إجمالية بلغت 94.6% ودرجة متوسطة بلغت 94.4% على التوالي، وذلك في PinchBench v2.

في التقييم الشامل لــ148 مهمة حقيقية، يتفوّق وكيل مهمة مساعد ون فين من بايدو على النماذج الرائدة في الداخل والخارج مثل Anthropic Claude Opus 4.8-fast وAli Qwen3.7-max وNVIDIA Nemotron-3 Ultra وOpenAI GPT-5.6-luna. يعتمد ترتيب PinchBench v2 كمعيار اختبار أساسي على 148 مهمة حقيقية لأتمتة الشركات، ويغطي سيناريوهات متعددة الأبعاد تشمل المحتوى الإبداعي والكتابة وتحليل البيانات والمعرفة البحثية وتشغيل/صيانة الكود وغيرها. وتُظهر بيانات الترتيب أن وكيل مهمة مساعد ون فين حصل على شهادات تقييم متقدمة في عدة فئات مثل المحتوى الإبداعي ومحتوى الكتابة. كما برز أداؤه في استدعاء الأدوات، والتخطيط المستقل للمهام متعددة الخطوات، وقدرات تنفيذ المهام الطويلة. وفي عملية التقييم هذه، قام فريق بحث AI من بايدو بإطلاق النسخة مفتوحة المصدر على GitHub تحت اسم Orion Mission Mode.

据悉، مهمة وكلاء مساعد ونسي تعتمد على تراكم تقني لسنوات بما يفوق 20 سنة من بحث بايدو وإمكانات إطار متعدد العوامل لمحرّك بايدو للبحث «أوريون» التابع لذكاء اصطناعي، لتوفير قاعدة نماذج محلية المنشأ قابلة للتحكم ذاتيًا وعالية الأداء لتطوير تطبيقات الوكلاء. وفي الوقت الحالي، تم تطبيق هذه التقنية الأساسية بالكامل في تطبيق بايدو و«مساعد ونسي».