英伟达正全力研发至少达1万亿参数的开源模型Nemotron 4,旨在降低对OpenAI等头部客户及云巨头的依赖。公司不仅通过回租服务器将云服务算力承诺大幅增至280亿美元,还组建了包括Mistral、Cursor等在内的「Nemotron联盟」共建生态。英伟达美股盘前涨近2%。
英伟达正大力押注自研开源人工智能模型,试图以此扩大GPU需求——尽管这一策略同时将其推入与自身客户和投资对象正面竞争的微妙处境。
Laporan The Information pada tanggal 11 menyebutkan bahwa target NVIDIA adalah menyamai level kinerja versi terbesar Nemotron 4 dengan model open-source teratas di dunia. Sejumlah karyawan mengungkapkan bahwa jumlah parameter model tersebut diperkirakan setidaknya mencapai 1 triliun—sekitar dua kali ukuran Nemotron 3 Ultra, model terbesar yang ada saat ini. Wakil presiden AI generatif NVIDIA, Kari Briski, dalam sebuah email mengatakan, "NVIDIA berinvestasi pada Nemotron karena kami yakin setiap perusahaan dan setiap negara membutuhkan model open-source mutakhir yang dapat diakses."
Permintaan chip NVIDIA saat ini sangat terkonsentrasi pada sejumlah kecil laboratorium ujung teknologi dan penyedia layanan cloud seperti OpenAI, Microsoft, dan SpaceX, sementara lembaga-lembaga tersebut semakin menyusun strategi untuk mengembangkan chip AI sendiri. Dorongan untuk Nemotron 4 bertujuan memperluas basis permintaan ke segmen pengguna perusahaan yang lebih luas, sehingga menurunkan ketergantungan NVIDIA pada pelanggan-pelanggan papan atas. Anastasios Angelopoulos, CEO lembaga evaluasi model AI Arena, mengatakan, "Apa pun perusahaan yang membuat model open-source yang hebat, NVIDIA tetap menjadi pemenang."
Saham NVIDIA di pra-pasar AS naik hampir 2%.

Target miliaran parameter, lonjakan investasi komputasi tiga kali lipat
Menurut sejumlah karyawan yang terlibat dalam proyek Nemotron, jumlah parameter terbesar dari model Nemotron 4 yang direncanakan NVIDIA setidaknya akan mencapai 1 triliun—sekitar dua kali ukuran model terbesar yang dirilis NVIDIA pada bulan Juni tahun ini, yaitu Nemotron 3 Ultra. Skala parameter model ini masih jauh lebih rendah dibanding model open-source teratas dari Tiongkok, tetapi NVIDIA juga menegaskan bahwa teknologi kompresinya dapat membuat model yang lebih kecil menunjukkan performa yang melampaui.
Dari sisi investasi komputasi, tekad NVIDIA tercermin dalam ekspansi besar atas komitmen dananya. Diketahui, perusahaan memperoleh daya komputasi dengan menyewakan server AI yang dibeli oleh penyedia layanan cloud yang menggunakan chip NVIDIA. Hingga April tahun ini, total nilai komitmen layanan cloud jangka panjang NVIDIA telah meningkat menjadi 28 miliar dolar AS di awal tahun 2031—sekitar tiga kali dari angka yang diungkapkan setahun sebelumnya. Untuk pengeluaran terkait pada tahun fiskal ini (hingga Januari 2028), anggarannya sekitar 7 miliar dolar AS; meski jauh lebih rendah daripada skala investasi OpenAI dan Anthropic, jumlah tersebut sudah melampaui total akumulasi pendanaan historis dari kebanyakan laboratorium open-source terkemuka di Amerika Serikat dan Tiongkok.
Dalam skala jumlah personel riset dan pengembangan, proyek Nemotron juga terus berkembang. Naskah riset untuk model penting NVIDIA sebelumnya memiliki hingga 570 penulis. Sejumlah karyawan mengatakan bahwa jumlah peserta untuk Nemotron 4 akan lebih banyak. "Sekarang semua orang ingin ikut, " kata seorang mantan karyawan.
Membentuk "Aliansi Nemotron", merangkul mitra ekosistem open-source secara luas
Untuk mempercepat pengembangan Nemotron 4, NVIDIA membangun jaringan kerja sama bernama "Aliansi Nemotron". Anggotanya mencakup pengembang open-source seperti Reflection, Cursor, Thinking Machines, dan Mistral. Di tengah upaya masing-masing pihak mendorong proyek model mereka sendiri, mereka juga berkontribusi pada Nemotron 4 dengan data pelatihan, dukungan evaluasi, dan rancangan desain model.
Selain itu, menurut seorang pihak yang terlibat langsung dalam kerja sama ini, startup pelatihan model Prime Intellect telah menyumbangkan 300.000 lingkungan simulasi untuk proyek tersebut guna membantu pelatihan model. Startup alat pemrograman AI Cognition juga termasuk dalam anggota aliansi; menurut orang dalam, perusahaan tersebut telah membahas pemberian data pelatihan kode kepada NVIDIA, namun kerja sama terkait belum diumumkan secara resmi ke publik.
Motivasi keterlibatan anggota aliansi beragam. Sebagian perusahaan berharap dapat memperluas pangsa pasar dengan memanfaatkan dorongan NVIDIA terhadap ekosistem open-source; sementara yang lain ingin mempengaruhi arah pengembangan model berkualitas tinggi yang dapat mereka gunakan dengan biaya lebih rendah, sehingga menghindari tekanan untuk menanggung biaya pelatihan komputasi secara mandiri. Vincent Weisser, CEO Prime Intellect, memposisikan aliansi ini sebagai tindakan kolektif untuk melawan monopoli satu "model dewa", bukan permainan zero-sum dalam perebutan gelar model open-source terbaik.
Batas antara pelanggan dan kompetitor semakin kabur
Perintah pendorong Nemotron 4 membuat NVIDIA terjebak dalam ketegangan struktural yang halus. Di satu sisi, OpenAI selama ini merupakan penggerak penting permintaan chip NVIDIA—NVIDIA bahkan telah berinvestasi 30 miliar dolar AS; di sisi lain, penempatan Nemotron 4 justru menawarkan solusi alternatif dengan biaya lebih rendah bagi perusahaan, yang bersaing dengan model bisnis laboratorium-laboratorium ujung teknologi seperti OpenAI. Pada saat yang sama, perusahaan-perusahaan dalam aliansi seperti Reflection AI dan Thinking Machines juga merupakan startup open-source yang sudah mendapat suntikan dana dari NVIDIA.
Namun, bagi NVIDIA, logika kompetisi ini tidak selalu permainan zero-sum. Anastasios Angelopoulos, CEO Arena, mengatakan: "Apa pun perusahaan yang membuat model open-source yang hebat, NVIDIA tetap menjadi pemenang." Logika inti NVIDIA adalah: semakin makmur ekosistem open-source dan semakin beragam pihak yang terlibat, semakin kuat permintaan total terhadap GPU.
Saat ini, model seri Nemotron sudah mendapatkan adopsi pasar tertentu. Palantir pada bulan Juni mengumumkan kerja sama dengan NVIDIA untuk menggunakan model Nemotron bagi pelanggan pemerintah AS. Namun, berdasarkan data benchmark dari lembaga seperti Arena dan Artificial Analysis, model terbesar NVIDIA yang ada saat ini, Nemotron 3 Ultra, hanya berada di peringkat kedua di antara model open-source di AS—di belakang model Inkling yang baru dirilis oleh Thinking Machines. Di peringkat model secara global, posisinya juga berada di luar 40 besar.
Timeline rilis masih belum jelas
Meski skala proyek besar, waktu rilis Nemotron 4 masih menyimpan ketidakpastian yang signifikan. Sejumlah karyawan mengatakan bahwa NVIDIA telah membuat beberapa keputusan mengenai data pra-pelatihan dan arsitektur, tetapi spesifikasi dan tanggal rilis belum dipastikan sepenuhnya. Tahap pelatihan akhir juga belum dimulai dan diperkirakan memakan waktu beberapa bulan. Dua karyawan berpendapat model mungkin paling cepat dirilis pada akhir musim gugur tahun ini, sementara karyawan lain memperkirakan waktunya bisa lebih terlambat.
Sementara itu, minggu ini NVIDIA telah merilis versi yang lebih kecil dari seri Nemotron—Nemotron 3.5 Lightning. Model ini menonjolkan kemampuan menjalankan tugas agen AI dengan kecepatan dan efisiensi setinggi mungkin. NVIDIA juga merilis perangkat lunak perutean model gratis untuk membantu perusahaan membangun alat perutean model buatan sendiri dengan lebih mudah, sehingga tugas AI tertentu dapat otomatis dialokasikan ke model pemrosesan yang paling optimal dan paling ekonomis.
Bryan Catanzaro, wakil presiden riset deep learning di NVIDIA, pada awal Januari tahun ini dalam sebuah podcast menyatakan, investasi pada Nemotron"sangat penting bagi masa depan perusahaan kami". CEO NVIDIA, Huang Renxun, juga menyatakan dukungan terbuka terhadap open-source dalam email pada bulan lalu, dengan menyebut bahwa model open-source"mendorong keamanan, keamanan jaringan, kemajuan sains, dan keamanan nasional".
