GPU 販売業者のTinygradが投稿し、信頼できる情報として、GLM 5.2モデルは2台のネットワーク接続されたBlackwellアーキテクチャのtinybox上で、毎秒120トークンの推論速度を実現できるという。 この構成の価格は15万米ドルで、標準のtinyboxを2台にするか、tinybox Proを1台にするかを選べるが、いずれも上記の性能を達成できる。 Tinygradはこれを売りにし、「一度購入すれば、クラウド費用は一切不要」というプライベート導入の方針を打ち出しており、従量課金のクラウド推論サービスに直接対抗している。 現時点でこの情報はGLM公式によってまだ確認されておらず、Tinygradもそれ以上の技術的詳細を開示していない。---------------------------------下の原文リンクをクリックして、Beating・飛書AIニュースチャンネルに参加し、7×24時間休まずに世界のAIホットトピックとニュースを継続監視する。