Suy luận lặng lẽ đang trở thành câu chuyện chuỗi cung ứng trị giá hàng nghìn tỷ USD tiếp theo. Năm 2023, suy luận chiếm khoảng 30% nhu cầu điện toán của AI. Đến năm 2030, con số này dự kiến lên tới 75%. Mọi chatbot, trợ lý lập trình, công cụ tìm kiếm và tác nhân sẽ cần năng lực điện toán liên tục để phản hồi theo thời gian thực.

Sự thay đổi này làm thay đổi toàn bộ cấu trúc hạ tầng.

$AVGO được hưởng lợi vì các chip AI tùy chỉnh được dự báo sẽ tăng từ 24% số lượng máy chủ AI xuất xưởng vào năm 2023 lên gần 40% vào năm 2030. Marvell đảm nhiệm mảng kết nối mạng — các cụm AI cần các kết nối quang tốc độ cao để truyền dữ liệu giữa hàng nghìn chip.

Coherent và Lumentum cung cấp các bộ thu/phát (transceivers) và laser đẩy dữ liệu qua sợi quang với tốc độ cao hơn. Celestica lắp ráp các máy chủ, tủ rack và hệ thống mạng thực tế cho khách hàng dịch vụ đám mây và AI.

Vertiv giải quyết bài toán về nhiệt. Khi các rack AI ngày càng mạnh hơn, làm mát bằng không khí bắt đầu không còn hoạt động hiệu quả, từ đó thúc đẩy nhu cầu làm mát bằng chất lỏng và quản lý nhiệt.

Eaton và Schneider Electric cung cấp hạ tầng điện — thiết bị đóng cắt, phân phối điện, máy biến áp, hệ thống dự phòng. Quanta Services xây dựng các đường truyền tải kết nối các khuôn viên AI với lưới điện.

Bộ nhớ cũng là một nút thắt khác. Suy luận yêu cầu mô hình phải luôn sẵn sàng và phản hồi ngay lập tức, từ đó thúc đẩy nhu cầu về bộ nhớ băng thông cao từ $MU, SanDisk, SK Hynix và Samsung.

Suy luận không chỉ là câu chuyện phần mềm. Nó đang tạo ra làn sóng thứ hai về nhu cầu hạ tầng vật lý, và chuỗi cung ứng đã bắt đầu định giá cho điều đó.