$NVDA đang chạy đồng thời hai chu kỳ sản phẩm — và các con số thật sự rất “điên rồ”.
Vera Rubin NVL72 hiện đã vào sản xuất. Lô hàng đầu tiên đã lăn ra từ dây chuyền tự động hóa hoàn toàn của Foxconn và được chuyển đến Microsoft. Google, Oracle, CoreWeave và SpaceX cũng đã được lên lịch. Groq 3 LPX đang được tăng tốc song song để phục vụ suy luận độ trễ thấp.
Mỗi khay tính toán của Rubin sử dụng MGX thế hệ thứ ba: không dây cáp, không quạt, không ống — làm mát bằng chất lỏng hoàn toàn. Một robot hoàn tất một khay mỗi phút. Giá đỡ chứa 18 khay tính toán và 9 khay chuyển mạch.
TrendForce dự báo GB300 sẽ tiếp tục là “trụ cột” trong giai đoạn đầu đến năm 2027, sau đó VR200 sẽ thay thế. Dự kiến lượng lô NVL72 theo các dòng GB và VR sẽ tăng 50%+ trong năm 2027. Điểm “ăn tiền” nằm ở đây: VR ASP xấp xỉ gấp đôi GB300. Khi chi phí wafer và HBM vẫn tiếp tục leo thang, giá trị NVL72 trong năm 2027 có thể chạm 710 tỷ USD — tăng 214%.
CEO luân phiên của Foxconn cho biết lượng xuất xưởng các rack cho AI đã tăng với mức hai chữ số cao trong Q3, khi Rubin trở thành sản phẩm chính của năm sau khi họ đuổi theo mục tiêu giành 50% thị phần server AI toàn cầu.
Quanta cho biết quá trình chuyển đổi sang Rubin đang diễn ra, kỳ vọng doanh thu server AI sẽ tăng hai chữ số trong quý này và tăng gấp đôi cho cả năm. Wistron đã bắt đầu sản xuất Rubin tại Đài Loan, và Texas sẽ là nơi tiếp theo.
Toàn bộ chuỗi cung ứng Đài Loan đang được huy động: TSMC, Foxconn, Quanta, Wistron, Wiwynn, Delta, AVC, Auras. Việc tăng tốc kép chỉ hoạt động nếu HBM và vật liệu nền có thể theo kịp với một tủ (cabinet) có giá gấp đôi.
Đó là “đặt cược”: hai động cơ chạy cùng lúc, mỗi tủ gấp đôi giá, và cơ sở hạ tầng phải đủ sức chịu đựng.
Vera Rubin NVL72 hiện đã vào sản xuất. Lô hàng đầu tiên đã lăn ra từ dây chuyền tự động hóa hoàn toàn của Foxconn và được chuyển đến Microsoft. Google, Oracle, CoreWeave và SpaceX cũng đã được lên lịch. Groq 3 LPX đang được tăng tốc song song để phục vụ suy luận độ trễ thấp.
Mỗi khay tính toán của Rubin sử dụng MGX thế hệ thứ ba: không dây cáp, không quạt, không ống — làm mát bằng chất lỏng hoàn toàn. Một robot hoàn tất một khay mỗi phút. Giá đỡ chứa 18 khay tính toán và 9 khay chuyển mạch.
TrendForce dự báo GB300 sẽ tiếp tục là “trụ cột” trong giai đoạn đầu đến năm 2027, sau đó VR200 sẽ thay thế. Dự kiến lượng lô NVL72 theo các dòng GB và VR sẽ tăng 50%+ trong năm 2027. Điểm “ăn tiền” nằm ở đây: VR ASP xấp xỉ gấp đôi GB300. Khi chi phí wafer và HBM vẫn tiếp tục leo thang, giá trị NVL72 trong năm 2027 có thể chạm 710 tỷ USD — tăng 214%.
CEO luân phiên của Foxconn cho biết lượng xuất xưởng các rack cho AI đã tăng với mức hai chữ số cao trong Q3, khi Rubin trở thành sản phẩm chính của năm sau khi họ đuổi theo mục tiêu giành 50% thị phần server AI toàn cầu.
Quanta cho biết quá trình chuyển đổi sang Rubin đang diễn ra, kỳ vọng doanh thu server AI sẽ tăng hai chữ số trong quý này và tăng gấp đôi cho cả năm. Wistron đã bắt đầu sản xuất Rubin tại Đài Loan, và Texas sẽ là nơi tiếp theo.
Toàn bộ chuỗi cung ứng Đài Loan đang được huy động: TSMC, Foxconn, Quanta, Wistron, Wiwynn, Delta, AVC, Auras. Việc tăng tốc kép chỉ hoạt động nếu HBM và vật liệu nền có thể theo kịp với một tủ (cabinet) có giá gấp đôi.
Đó là “đặt cược”: hai động cơ chạy cùng lúc, mỗi tủ gấp đôi giá, và cơ sở hạ tầng phải đủ sức chịu đựng.
