Nhà bán GPU Tinygrad cho biết, theo tin cậy, mô hình GLM 5.2 có thể đạt tốc độ suy luận 120 token mỗi giây trên hai máy tinybox thuộc kiến trúc Blackwell được kết nối mạng. Cấu hình này có giá 150.000 USD; có thể chọn hai máy tinybox tiêu chuẩn hoặc một máy tinybox Pro, đều có thể đạt hiệu năng như trên. Tinygrad dùng thông tin này làm điểm bán hàng, tập trung vào lộ trình triển khai nội bộ “mua một lần, không bao giờ phải trả phí đám mây”, nhắm trực tiếp vào các dịch vụ suy luận đám mây tính phí theo mức sử dụng. Hiện tin này vẫn chưa được phía GLM chính thức xác nhận, và Tinygrad cũng chưa công bố thêm chi tiết kỹ thuật.---------------------------------Bấm vào liên kết bài gốc bên dưới, tham gia kênh Tin tức AI của Feishu “Beating · 飞书 AI 新闻渠道”, theo dõi liên tục 24/7 các điểm nóng và tin tức AI toàn cầu.