DeepSeek 決定將籌碼推向自主算力底座的深水區。約 300 億元的算力擴充預算,加上最早第四季度進場的新一代華爲 Ascend 訓練芯片,讓大模型研發的分水嶺正式從前期的推理適配,推移到了數萬張卡連續高負荷運轉的萬卡集羣訓練主戰場。
這種基礎設施層面的激進轉向,正在重塑科技賽道的風險偏好與資金倉位結構。從 2 萬億參數邁向 8 萬億參數的模型體量,對芯片集羣的吞吐要求呈倍數級放大。海外供應鏈的不確定性與資本開支壓力的雙重擠壓,促使頭部團隊主動承受遷移成本,加速推動本土算力鏈條的估值重構。
這場高額下注的真正考驗在於工程落地的容錯空間。幾萬顆芯片的互聯通信、底層軟件棧優化以及連續數月的訓練穩定性,任何微小的短板都會被超大模型訓練急劇放大。產業與市場資金都在屏息等待第四季度新芯片交付後,首輪大規模長週期訓練給出的真實回測反饋。
這種基礎設施層面的激進轉向,正在重塑科技賽道的風險偏好與資金倉位結構。從 2 萬億參數邁向 8 萬億參數的模型體量,對芯片集羣的吞吐要求呈倍數級放大。海外供應鏈的不確定性與資本開支壓力的雙重擠壓,促使頭部團隊主動承受遷移成本,加速推動本土算力鏈條的估值重構。
這場高額下注的真正考驗在於工程落地的容錯空間。幾萬顆芯片的互聯通信、底層軟件棧優化以及連續數月的訓練穩定性,任何微小的短板都會被超大模型訓練急劇放大。產業與市場資金都在屏息等待第四季度新芯片交付後,首輪大規模長週期訓練給出的真實回測反饋。