A NVIDIA está empenhada em desenvolver em pleno ritmo um modelo aberto Nemotron 4 com pelo menos 1 trilhão de parâmetros, com o objetivo de reduzir a dependência de grandes clientes como a OpenAI e dos gigantes da computação em nuvem. A empresa não apenas aumentou significativamente suas promessas de capacidade de computação em nuvem para US$ 28 bilhões por meio de serviços de leaseback de servidores, como também montou a “Aliança Nemotron”, reunindo parceiros como a Mistral e a Cursor, para construir um ecossistema em conjunto. As ações da NVIDIA subiram cerca de 2% no pré-mercado dos EUA.
A NVIDIA está apostando forte em modelos de inteligência artificial abertos desenvolvidos internamente, tentando ampliar a demanda por GPUs — apesar de essa estratégia também colocá-la numa posição delicada de competição direta, ainda que indireta, com seus próprios clientes e alvos de investimento.
The Information 11日報道稱,英偉達目標是將Nemotron 4最大版本的性能打造至與全球頂尖開源模型比肩的水準。多名員工透露,該模型參數量預計至少達到一萬億——約爲其現有最大模型Nemotron 3 Ultra的兩倍。英偉達生成式AI副總裁Kari Briski在一封郵件中表示,"英偉達投資Nemotron,是因爲我們相信每家企業、每個國家都需要可及的前沿開源模型。"
英偉達當前的芯片需求高度集中於OpenAI、微軟、SpaceX等少數前沿實驗室和雲服務商,而上述機構正日益佈局自研AI芯片。Nemotron 4的推進旨在將需求基礎拓展至更廣泛的企業用戶群體,從而降低英偉達對頭部客戶的依賴。AI模型評測機構Arena的首席執行官Anastasios Angelopoulos表示,"無論哪家公司做出優秀的開源模型,英偉達都是贏家。"
英偉達美股盤前漲近2%。

Meta de parâmetros de mil milhões, salto triplo no investimento em capacidade de computação
據多名參與Nemotron項目的員工透露,英偉達計劃開發的最大規模Nemotron 4模型參數量至少達到1萬億,約爲其今年6月發佈的現有最大模型Nemotron 3 Ultra的兩倍。該模型參數規模仍將遠低於中國頭部開源模型,但英偉達同時強調其壓縮技術可使較小模型實現超越性的性能表現。
在算力投入層面,英偉達的決心體現於其資金承諾的大幅擴張。據悉,該公司通過向購買其芯片的雲服務商回租AI服務器獲取算力。截至今年4月,英偉達多年期雲服務承諾的總價值已增至2031年初的280億美元,約爲一年前披露金額的三倍。其中針對本財年(截至2028年1月)的相關支出約爲70億美元,雖遠低於OpenAI和Anthropic的投入規模,但已超過絕大多數美國和中國領先開源實驗室的歷史融資總額。
No tamanho da equipe de P&D, o projeto Nemotron também continua a se expandir. O artigo de pesquisa do último grande modelo da Nvidia teve até 570 autores, e vários funcionários disseram que haverá mais pessoas envolvidas no Nemotron 4. "Agora todo mundo quer participar", disse um ex-funcionário.
組建"Nemotron聯盟",廣納開源生態夥伴
爲加速Nemotron 4的研發,英偉達構建了一個名爲"Nemotron聯盟"的合作網絡,成員包括Reflection、Cursor、Thinking Machines和Mistral等開源開發商,各方在推進自身模型項目的同時,也向Nemotron 4貢獻訓練數據、評估支持和模型設計方案。
此外,據一位直接參與合作的人士透露,AI模型訓練初創公司Prime Intellect已向該項目貢獻了30萬個模擬環境,用於輔助模型訓練。AI編程工具初創公司Cognition也在聯盟成員之列,據知情人士透露,該公司已就向英偉達提供代碼訓練數據展開討論,但相關合作尚未正式對外公佈。
A motivação dos membros da aliança varia. Algumas empresas esperam ampliar a sua quota de mercado com o impulso da Nvidia ao ecossistema open source; outras esperam influenciar, com custos mais baixos, a direção do desenvolvimento de um modelo de alta qualidade que possa ser usado por elas próprias, evitando a pressão de assumir diretamente os custos de treino de computação. O CEO da Prime Intellect, Vincent Weisser, posiciona esta aliança como uma ação coletiva para combater a monopolização de um único "modelo divino", e não como um jogo de soma zero em busca do título de melhor modelo open source.
As fronteiras entre clientes e concorrentes ficam cada vez mais vagas
Nemotron 4的推進令英偉達陷入一種微妙的結構性張力之中。一方面,OpenAI長期以來是英偉達芯片需求的重要驅動方,英偉達已向其投資300億美元;另一方面,Nemotron 4的定位恰恰是爲企業提供成本更低的替代方案,與OpenAI等前沿實驗室的商業模型形成競爭。與此同時,聯盟中包含的Reflection AI和Thinking Machines等公司,也是英偉達已注資的開源創業企業。
不過,對英偉達而言,這一競爭邏輯並不必然是零和遊戲。AI模型評估機構Arena的首席執行官Anastasios Angelopoulos表示:"無論哪家公司做出優秀的開源模型,英偉達都是贏家。"英偉達的核心邏輯在於:開源生態越繁榮、參與主體越多元,GPU的整體需求就越旺盛。
目前,Nemotron系列模型已獲得一定市場採用,帕蘭提爾(Palantir)於今年6月宣佈與英偉達合作,將Nemotron模型用於美國政府客戶。但據Arena和Artificial Analysis等機構的基準測試數據,英偉達現有最大模型Nemotron 3 Ultra在美國開源模型中僅排名第二,位列Thinking Machines新發布的Inkling模型之後,在全球模型整體排名中更位於前40名之外。
O cronograma de lançamento ainda está incerto
儘管項目規模宏大,Nemotron 4的發佈時間仍存在較大不確定性。多名員工表示,英偉達已就預訓練數據和架構做出若干決策,但尚未最終確定具體規格和發佈日期,最終訓練階段亦尚未啓動,預計耗時數月。兩名員工認爲模型最快可在今年秋末發佈,另有員工認爲時間可能更晚。
與此同時,英偉達本週已發佈了Nemotron系列的一個較小版本——Nemotron 3.5 Lightning,該模型主打以儘可能快的速度和效率運行AI代理任務。英偉達同步發佈了免費的模型路由軟件,協助企業更便捷地構建自定義模型路由工具,將特定AI任務自動分配至最優、最經濟的模型處理。
英偉達應用深度學習研究副總裁Bryan Catanzaro今年1月在一檔播客中表示,投資Nemotron"對我們公司的未來至關重要"。英偉達首席執行官黃仁勳也在上月的一封郵件中公開表態支持開源,稱開源模型"促進安全、網絡安全、科學進步和國家安全"。
