$BTC عرض 79 ألف نخبة من الصف الأول، اليوم تغيّر ترتيب أفضل قائمة لأبحاث النماذج، وحلّ محلّها مسوّدة تدريب جديدة جديرة بالمتابعة:26 صوتًا، RetireOPD أدخل «التقطير عبر التقاعد الذاتي» في التعلم التعزيزي للعوامل الذكية. الفكرة الأساسية هي أن الاستراتيجية القديمة تتنحّى طواعية، بينما الاستراتيجية الجديدة تتولى مباشرةً التعلّم على بيانات قديمة مُدرّجة بالأوزان. بالمقارنة مع التقطير التقليدي «بقطع واحد» واعتماد نسخ كاملة، فإن آلية التقاعد هذه أقرب إلى السيناريو الحقيقي لبروتوكولات الوكلاء على السلسلة؛ فالعُقد ليست قابلة للتوسّع بلا حدود، بل تُدار بالتناوب وفقًا لمستوى المساهمة. $FET $TAO حزمة ثلاثية تعمل كفهرس للوكيل وتعاون بين الشبكات الفرعية. وعلى سلسلة سولانا، البروتوكول الوكيل في نفس اتجاه تلك الحزمة. إذا نجحت هذه الطريقة الجديدة في تشغيل «التقاعد الذاتي»، فسيكون لدينا أساس هندسي جاهز لآلية احتساب نقاط العقد واستمرار وراثة الأوزان. طوال الأسبوع، كانت أبحاث النماذج تتراكم على مستوى التنفيذ واستدعاءات أدوات. اليوم أخيرًا عاد كل شيء إلى جانب التدريب للبحث عن متغيرات جديدة.
#代理训练新做法 #自退役蒸馏 #AI