OpenClaw đã nhóm lửa, GLM-5.2 đã cho củi
OpenClaw khiến công ty mô hình lần đầu nếm được “ngọt” của kinh tế Token—lượng gọi trong một tháng đạt 10,4 vạn tỷ lần, đường doanh thu bật thẳng đứng.
Ngày 17 tháng 6, GLM-5.2 được mã nguồn mở. Lần này thì khác.
Giấy phép MIT: muốn sửa tùy ý, muốn bán tùy ý, quyền sở hữu trí tuệ về con số 0. Doanh nghiệp yên tâm nhúng vào sản phẩm thương mại, sửa xong cũng không cần nộp lại. So với GPL dạng lây nhiễm, tương đương với việc tháo bỏ ngưỡng cửa.
Quan trọng hơn là—AI từ nay bước vào kỷ nguyên suy luận dài.
Trước đây là chạy nước rút. Mỗi nhiệm vụ có khung thời gian giới hạn, kế hoạch thực thi kết thúc, KV Cache được kiểm soát, áp lực nằm ở năng lực tính toán.
Sau GLM-5.2 là chạy marathon. Ngữ cảnh toàn vẹn 1M—một nhiệm vụ giữ toàn bộ mã nguồn, toàn bộ lịch sử ra quyết định, toàn bộ điều kiện ràng buộc. Đo thực tế xử lý một lần đạt 880 nghìn tokens, cửa sổ hầu như bị “ăn” đầy.
Agent không còn là cỗ máy hỏi–đáp. Nó phân rã mục tiêu → lập kế hoạch nhiều vòng → kiểm chứng lặp lại → gọi công cụ → viết mã chạy mã → rồi dựa trên phản hồi để lập kế hoạch lại. Một nhiệm vụ kích hoạt hàng trăm lần vòng suy luận; mức tiêu hao Token từ tuyến tính chuyển thành lũy thừa.
Mỗi vòng lặp, toàn bộ ngữ cảnh được nạp lại vào bộ nhớ để tính toán lại. Tính toán liên tục, giao tiếp liên tục, đọc/ghi liên tục. Ba “liên tục” này đã thay đổi triệt để logic định giá của phần cứng.
Suy luận của Agent tầm xa có lợi cho gì?
HBM
KV Cache tăng tuyến tính theo số vòng và độ dài ngữ cảnh, nhanh chóng lấp đầy bộ nhớ GPU HBM. Chỉ cần rời khỏi nội địa, băng thông từ TB/s rơi xuống trăm GB/s. Vấn đề từ chỗ năng lực tính toán chuyển thành băng thông bộ nhớ. Ba “đại xưởng” công suất bán hết sạch, khoảng thiếu 50%-60%, quy mô thị trường 546 tỷ USD vào năm 2026.
Chip quang/InP
Chạy suy luận tầm xa trên cụm sẽ tạo ra lượng truyền thông khủng giữa các card. Mô-đun quang tăng trưởng 60% mỗi năm trong năm 2026, đạt 26 tỷ USD; thiếu nền đế InP 70%+; giá Indium tăng 90% so với cùng kỳ.
CPU
Suy luận tầm xa dựa vào CPU cho điều phối tác vụ, phân rã nhiệm vụ và quản lý KV Cache. Tỷ lệ phối GPU từ 1:8 tiến gần 1:1. CEO của Intel nói rằng nhiều CEO đã gọi điện thúc mua hàng.
Làm mát bằng chất lỏng
Suy luận tầm xa chạy tải liên tục; với cùng một card, mức tiêu thụ điện năng cao gấp 3-5 lần so với suy luận ngắn. Công suất tiêu thụ của tủ rack từ 36kW nhảy lên 200kW. Làm mát bằng gió không chịu nổi.
Switch
Nhu cầu băng thông của cụm suy luận tăng từ 100G lên 400G. Hàng trăm nghìn card cần điều phối, IB và Ethernet đều được hưởng lợi trên toàn tuyến.
Bo mạch ABF
Từ việc tăng cụm từ hàng nghìn card lên vạn card, mỗi con chip đều phải đóng gói. Ajinomoto độc quyền hơn 90% màng ABF, đến năm 2028 thiếu 42%. Giá bột mì tăng, bánh mì chỉ có thể đắt hơn.
CCL M9
Cả backplane bo mạch chủ đều cần vật liệu nền tốc độ cao. Giá đơn vị M9 là gấp 10 lần FR4; thị trường năm 2027 đạt 18,7 tỷ USD, tốc độ tăng vượt mô-đun quang.
OpenClaw nhóm lửa, GLM-5.2 cho củi. Cái trước giúp các công ty mô hình kiếm được “thùng Token” đầu tiên; cái sau giúp thị trường từ phòng thí nghiệm bước ra ngành công nghiệp.
Ở trong kho lưu trữ của sàn, trong kho quang của sàn—hưởng bọt.
$MU
$SKHYNIX
$LITE
OpenClaw khiến công ty mô hình lần đầu nếm được “ngọt” của kinh tế Token—lượng gọi trong một tháng đạt 10,4 vạn tỷ lần, đường doanh thu bật thẳng đứng.
Ngày 17 tháng 6, GLM-5.2 được mã nguồn mở. Lần này thì khác.
Giấy phép MIT: muốn sửa tùy ý, muốn bán tùy ý, quyền sở hữu trí tuệ về con số 0. Doanh nghiệp yên tâm nhúng vào sản phẩm thương mại, sửa xong cũng không cần nộp lại. So với GPL dạng lây nhiễm, tương đương với việc tháo bỏ ngưỡng cửa.
Quan trọng hơn là—AI từ nay bước vào kỷ nguyên suy luận dài.
Trước đây là chạy nước rút. Mỗi nhiệm vụ có khung thời gian giới hạn, kế hoạch thực thi kết thúc, KV Cache được kiểm soát, áp lực nằm ở năng lực tính toán.
Sau GLM-5.2 là chạy marathon. Ngữ cảnh toàn vẹn 1M—một nhiệm vụ giữ toàn bộ mã nguồn, toàn bộ lịch sử ra quyết định, toàn bộ điều kiện ràng buộc. Đo thực tế xử lý một lần đạt 880 nghìn tokens, cửa sổ hầu như bị “ăn” đầy.
Agent không còn là cỗ máy hỏi–đáp. Nó phân rã mục tiêu → lập kế hoạch nhiều vòng → kiểm chứng lặp lại → gọi công cụ → viết mã chạy mã → rồi dựa trên phản hồi để lập kế hoạch lại. Một nhiệm vụ kích hoạt hàng trăm lần vòng suy luận; mức tiêu hao Token từ tuyến tính chuyển thành lũy thừa.
Mỗi vòng lặp, toàn bộ ngữ cảnh được nạp lại vào bộ nhớ để tính toán lại. Tính toán liên tục, giao tiếp liên tục, đọc/ghi liên tục. Ba “liên tục” này đã thay đổi triệt để logic định giá của phần cứng.
Suy luận của Agent tầm xa có lợi cho gì?
HBM
KV Cache tăng tuyến tính theo số vòng và độ dài ngữ cảnh, nhanh chóng lấp đầy bộ nhớ GPU HBM. Chỉ cần rời khỏi nội địa, băng thông từ TB/s rơi xuống trăm GB/s. Vấn đề từ chỗ năng lực tính toán chuyển thành băng thông bộ nhớ. Ba “đại xưởng” công suất bán hết sạch, khoảng thiếu 50%-60%, quy mô thị trường 546 tỷ USD vào năm 2026.
Chip quang/InP
Chạy suy luận tầm xa trên cụm sẽ tạo ra lượng truyền thông khủng giữa các card. Mô-đun quang tăng trưởng 60% mỗi năm trong năm 2026, đạt 26 tỷ USD; thiếu nền đế InP 70%+; giá Indium tăng 90% so với cùng kỳ.
CPU
Suy luận tầm xa dựa vào CPU cho điều phối tác vụ, phân rã nhiệm vụ và quản lý KV Cache. Tỷ lệ phối GPU từ 1:8 tiến gần 1:1. CEO của Intel nói rằng nhiều CEO đã gọi điện thúc mua hàng.
Làm mát bằng chất lỏng
Suy luận tầm xa chạy tải liên tục; với cùng một card, mức tiêu thụ điện năng cao gấp 3-5 lần so với suy luận ngắn. Công suất tiêu thụ của tủ rack từ 36kW nhảy lên 200kW. Làm mát bằng gió không chịu nổi.
Switch
Nhu cầu băng thông của cụm suy luận tăng từ 100G lên 400G. Hàng trăm nghìn card cần điều phối, IB và Ethernet đều được hưởng lợi trên toàn tuyến.
Bo mạch ABF
Từ việc tăng cụm từ hàng nghìn card lên vạn card, mỗi con chip đều phải đóng gói. Ajinomoto độc quyền hơn 90% màng ABF, đến năm 2028 thiếu 42%. Giá bột mì tăng, bánh mì chỉ có thể đắt hơn.
CCL M9
Cả backplane bo mạch chủ đều cần vật liệu nền tốc độ cao. Giá đơn vị M9 là gấp 10 lần FR4; thị trường năm 2027 đạt 18,7 tỷ USD, tốc độ tăng vượt mô-đun quang.
OpenClaw nhóm lửa, GLM-5.2 cho củi. Cái trước giúp các công ty mô hình kiếm được “thùng Token” đầu tiên; cái sau giúp thị trường từ phòng thí nghiệm bước ra ngành công nghiệp.
Ở trong kho lưu trữ của sàn, trong kho quang của sàn—hưởng bọt.
$MU
$SKHYNIX
$LITE
