英偉達正全力研發至少達1萬億參數的開源模型Nemotron 4,旨在降低對OpenAI等頭部客戶及雲巨頭的依賴。公司不僅通過回租服務器將雲服務算力承諾大幅增至280億美元,還組建了包括Mistral、Cursor等在內的「Nemotron聯盟」共建生態。英偉達美股盤前漲近2%。

英偉達正大力押注自研開源人工智能模型,試圖以此擴大GPU需求——儘管這一策略同時將其推入與自身客戶和投資對象正面競爭的微妙處境。

The Information 11日報道稱,英偉達目標是將Nemotron 4最大版本的性能打造至與全球頂尖開源模型比肩的水準。多名員工透露,該模型參數量預計至少達到一萬億——約爲其現有最大模型Nemotron 3 Ultra的兩倍。英偉達生成式AI副總裁Kari Briski在一封郵件中表示,"英偉達投資Nemotron,是因爲我們相信每家企業、每個國家都需要可及的前沿開源模型。"

英偉達當前的芯片需求高度集中於OpenAI、微軟、SpaceX等少數前沿實驗室和雲服務商,而上述機構正日益佈局自研AI芯片。Nemotron 4的推進旨在將需求基礎拓展至更廣泛的企業用戶羣體,從而降低英偉達對頭部客戶的依賴。AI模型評測機構Arena的首席執行官Anastasios Angelopoulos表示,"無論哪家公司做出優秀的開源模型,英偉達都是贏家。"

英偉達美股盤前漲近2%。

千億參數目標,算力投入三倍躍升

據多名參與Nemotron項目的員工透露,英偉達計劃開發的最大規模Nemotron 4模型參數量至少達到1萬億,約爲其今年6月發佈的現有最大模型Nemotron 3 Ultra的兩倍。該模型參數規模仍將遠低於中國頭部開源模型,但英偉達同時強調其壓縮技術可使較小模型實現超越性的性能表現。

在算力投入層面,英偉達的決心體現於其資金承諾的大幅擴張。據悉,該公司通過向購買其芯片的雲服務商回租AI服務器獲取算力。截至今年4月,英偉達多年期雲服務承諾的總價值已增至2031年初的280億美元,約爲一年前披露金額的三倍。其中針對本財年(截至2028年1月)的相關支出約爲70億美元,雖遠低於OpenAI和Anthropic的投入規模,但已超過絕大多數美國和中國領先開源實驗室的歷史融資總額。

在研發人員規模上,Nemotron項目同樣持續擴張。英偉達上一個重要模型的研究論文署名作者多達570人,多名員工表示Nemotron 4的參與人數將更多。"現在每個人都想參與進來,"一位前員工說。

組建"Nemotron聯盟",廣納開源生態夥伴

爲加速Nemotron 4的研發,英偉達構建了一個名爲"Nemotron聯盟"的合作網絡,成員包括Reflection、Cursor、Thinking Machines和Mistral等開源開發商,各方在推進自身模型項目的同時,也向Nemotron 4貢獻訓練數據、評估支持和模型設計方案。

此外,據一位直接參與合作的人士透露,AI模型訓練初創公司Prime Intellect已向該項目貢獻了30萬個模擬環境,用於輔助模型訓練。AI編程工具初創公司Cognition也在聯盟成員之列,據知情人士透露,該公司已就向英偉達提供代碼訓練數據展開討論,但相關合作尚未正式對外公佈。

聯盟成員的參與動機各異。部分公司希望藉助英偉達對開源生態的推動擴大市場份額;另一些則期望以較低成本影響一個可供自身使用的高質量模型的研發方向,從而規避自行承擔訓練算力成本的壓力。Prime Intellect首席執行官Vincent Weisser將這一聯盟定位爲對抗單一"神級"模型壟斷的集體行動,而非一場爭奪最佳開源模型名號的零和博弈。

客戶與競爭對手的邊界趨於模糊

Nemotron 4的推進令英偉達陷入一種微妙的結構性張力之中。一方面,OpenAI長期以來是英偉達芯片需求的重要驅動方,英偉達已向其投資300億美元;另一方面,Nemotron 4的定位恰恰是爲企業提供成本更低的替代方案,與OpenAI等前沿實驗室的商業模型形成競爭。與此同時,聯盟中包含的Reflection AI和Thinking Machines等公司,也是英偉達已注資的開源創業企業。

不過,對英偉達而言,這一競爭邏輯並不必然是零和遊戲。AI模型評估機構Arena的首席執行官Anastasios Angelopoulos表示:"無論哪家公司做出優秀的開源模型,英偉達都是贏家。"英偉達的核心邏輯在於:開源生態越繁榮、參與主體越多元,GPU的整體需求就越旺盛。

目前,Nemotron系列模型已獲得一定市場採用,帕蘭提爾(Palantir)於今年6月宣佈與英偉達合作,將Nemotron模型用於美國政府客戶。但據Arena和Artificial Analysis等機構的基準測試數據,英偉達現有最大模型Nemotron 3 Ultra在美國開源模型中僅排名第二,位列Thinking Machines新發布的Inkling模型之後,在全球模型整體排名中更位於前40名之外。

發佈時間表仍不明朗

儘管項目規模宏大,Nemotron 4的發佈時間仍存在較大不確定性。多名員工表示,英偉達已就預訓練數據和架構做出若干決策,但尚未最終確定具體規格和發佈日期,最終訓練階段亦尚未啓動,預計耗時數月。兩名員工認爲模型最快可在今年秋末發佈,另有員工認爲時間可能更晚。

與此同時,英偉達本週已發佈了Nemotron系列的一個較小版本——Nemotron 3.5 Lightning,該模型主打以儘可能快的速度和效率運行AI代理任務。英偉達同步發佈了免費的模型路由軟件,協助企業更便捷地構建自定義模型路由工具,將特定AI任務自動分配至最優、最經濟的模型處理。

英偉達應用深度學習研究副總裁Bryan Catanzaro今年1月在一檔播客中表示,投資Nemotron"對我們公司的未來至關重要"。英偉達首席執行官黃仁勳也在上月的一封郵件中公開表態支持開源,稱開源模型"促進安全、網絡安全、科學進步和國家安全"。