Inferensi secara diam-diam sedang menjadi kisah rantai pasok berikutnya bernilai triliunan dolar. Pada 2023, inferensi kira-kira mencapai 30% dari kebutuhan komputasi AI. Pada 2030, diperkirakan meningkat menjadi 75%. Setiap chatbot, asisten pemrograman, mesin pencari, dan agen akan membutuhkan daya komputasi yang konstan untuk merespons secara real time.
Perubahan ini mengubah seluruh tumpukan infrastruktur.
$AVGO diuntungkan karena chip AI khusus diproyeksikan tumbuh dari 24% pengiriman server AI pada 2023 menjadi hampir 40% pada 2030. Marvell berperan di sisi jaringan — klaster AI membutuhkan koneksi optik berkecepatan tinggi untuk memindahkan data di antara ribuan chip.
Coherent dan Lumentum memasok transceiver dan laser yang mendorong data melalui serat dengan kecepatan lebih tinggi. Celestica membangun server, rak, dan sistem jaringan yang benar-benar digunakan untuk pelanggan cloud dan AI.
Vertiv menangani masalah panas. Saat rak AI menjadi lebih bertenaga, pendinginan udara tidak lagi cukup, sehingga mendorong meningkatnya permintaan untuk pendinginan cair dan manajemen termal.
Eaton dan Schneider Electric menyediakan infrastruktur kelistrikan — switchgear, distribusi daya, trafo, sistem cadangan. Quanta Services membangun jalur transmisi yang menghubungkan kampus AI ke jaringan listrik.
Memori juga menjadi hambatan lain. Inferensi membutuhkan model untuk tetap dimuat dan merespons seketika, yang mendukung permintaan akan memori berbandwidth tinggi dari $MU, SanDisk, SK Hynix, dan Samsung.
Inferensi bukan sekadar cerita perangkat lunak. Ini menciptakan gelombang kedua dari kebutuhan infrastruktur fisik, dan rantai pasoknya sudah memasukkan penilaian tersebut ke dalam harga.
Perubahan ini mengubah seluruh tumpukan infrastruktur.
$AVGO diuntungkan karena chip AI khusus diproyeksikan tumbuh dari 24% pengiriman server AI pada 2023 menjadi hampir 40% pada 2030. Marvell berperan di sisi jaringan — klaster AI membutuhkan koneksi optik berkecepatan tinggi untuk memindahkan data di antara ribuan chip.
Coherent dan Lumentum memasok transceiver dan laser yang mendorong data melalui serat dengan kecepatan lebih tinggi. Celestica membangun server, rak, dan sistem jaringan yang benar-benar digunakan untuk pelanggan cloud dan AI.
Vertiv menangani masalah panas. Saat rak AI menjadi lebih bertenaga, pendinginan udara tidak lagi cukup, sehingga mendorong meningkatnya permintaan untuk pendinginan cair dan manajemen termal.
Eaton dan Schneider Electric menyediakan infrastruktur kelistrikan — switchgear, distribusi daya, trafo, sistem cadangan. Quanta Services membangun jalur transmisi yang menghubungkan kampus AI ke jaringan listrik.
Memori juga menjadi hambatan lain. Inferensi membutuhkan model untuk tetap dimuat dan merespons seketika, yang mendukung permintaan akan memori berbandwidth tinggi dari $MU, SanDisk, SK Hynix, dan Samsung.
Inferensi bukan sekadar cerita perangkat lunak. Ini menciptakan gelombang kedua dari kebutuhan infrastruktur fisik, dan rantai pasoknya sudah memasukkan penilaian tersebut ke dalam harga.
