🚨 $KIMI ຊຸກຫຍຸ້ນລົງ 2.78T PARAMETERS ໃຫ້ເຫຼືອ 8GB RAM — ໂດຍບໍ່ໃຊ້ GPU! 💥
🔍 ການທົດລອງ Open-source ນີ້ທ້າທາຍທຸກຄວາມຄິດຖານກ່ຽວກັບການຂະຫຍາຍ inference. ໂປຣເຈັກຊັນ C99 ພິເສດ 176KB ແບບບໍລິສຸດ ສາມາດໃຊ້ນ້ຳໜັກຊຸດ 1.56TB ຂອງ Kimi K3 ໄດ້ດ້ວຍພຽງ 8GB ຜ່ານການ streaming expert weights ຈາກ NVMe ຕາມຄວາມຕ້ອງການ. 💡
ຄວາມຈິນຕະນາການແມ່ນ MoE sparse activation — ພຽງ 16 ຈາກ 896 experts ທີ່ຖືກເປີດໃຊ້ຕໍ່ແຕ່ລະ layer. ສະນັ້ນນັກພັດທະນາຍອມແລກ flash storage bandwidth ແທນ RAM, ປະຕິບັດໃຫ້ໄດ້ດິສຄ໌ຄືການຂະຫຍາຍ memory ທີ່ຊ້າ. 📊 ການແລກແມ່ນແຮງຫຼາຍ: ໜຶ່ງ token ໃນ 32.7 ວິນາທີ. ນັ້ນບໍ່ພ້ອມໃຊ້ໃນ production, ແຕ່ເປັນແຜນຜັງຂອງໂຄງສ້າງສໍາລັບ inference ທີ່ລາຄາຕໍ່າຫຼາຍ.
ສັນຍານທີ່ຊັດກວ່າກໍຄືທິດທາງ. 📉 ເມື່ອຂໍ້ຈໍາກັດຂອງ hardware ບັງຄັບໃຫ້ອອກແບບແບບຄິດສ້າງ, ຄວາມມີປະສິດທິພາບຈະກາຍເປັນເລື່ອງເລົ່າຕໍ່ໄປ. ພວກເຮົາກໍາລັງສ້າງທໍ່ປະປາໃຫ້ກັບຄືນຂອງ decentralized AI ຄັ້ງຕໍ່ໄປບໍ? 💬
⚠️ ບໍ່ແມ່ນຄໍາແນະນໍາດ້ານການເງິນ. ຈົ່ງຈັດການຄວາມສ່ຽງຂອງທ່ານສະເໝີ. 🛡️
🏷️
#KIMI #AI #MoE #OpenSource #Crypto 💡 🔥