Pengecer GPU Tinygrad mengunggah pernyataan, menyebutkan bahwa menurut informasi yang dapat dipercaya, model GLM 5.2 dapat mencapai kecepatan inferensi 120 token per detik pada dua unit tinybox yang terhubung dengan arsitektur Blackwell. Konfigurasi ini dibanderol seharga 150.000 dolar AS; tersedia opsi dua unit tinybox standar atau satu unit tinybox Pro, dan keduanya dapat mencapai performa tersebut. Tinygrad menjadikannya sebagai nilai jual, dengan mengusung jalur privatisasi “beli sekali, tidak pernah membayar biaya cloud”, langsung menyasar layanan inferensi cloud berbasis bayar-per-saat. Hingga kini, kabar tersebut belum diverifikasi oleh pihak resmi GLM, dan Tinygrad juga belum mengungkap rincian teknis lebih lanjut.---------------------------------Klik tautan artikel asli di bawah ini, gabung dengan Beating · Kanal Berita AI Feishu, lakukan pemantauan 24 jam (7×24) tanpa henti terhadap tren dan berita hangat AI global.