DeepSeek 决定将筹码推向自主算力底座的深水区。约 300 亿元的算力扩充预算,加上最早第四季度进场的新一代华为 Ascend 训练芯片,让大模型研发的分水岭正式从前期的推理适配,推移到了数万张卡连续高负荷运转的万卡集群训练主战场。
这种基础设施层面的激进转向,正在重塑科技赛道的风险偏好与资金仓位结构。从 2 万亿参数迈向 8 万亿参数的模型体量,对芯片集群的吞吐要求呈倍数级放大。海外供应链的不确定性与资本开支压力的双重挤压,促使头部团队主动承受迁移成本,加速推动本土算力链条的估值重构。
这场高额下注的真正考验在于工程落地的容错空间。几万颗芯片的互联通信、底层软件栈优化以及连续数月的训练稳定性,任何微小的短板都会被超大模型训练急剧放大。产业与市场资金都在屏息等待第四季度新芯片交付后,首轮大规模长周期训练给出的真实回测反馈。
这种基础设施层面的激进转向,正在重塑科技赛道的风险偏好与资金仓位结构。从 2 万亿参数迈向 8 万亿参数的模型体量,对芯片集群的吞吐要求呈倍数级放大。海外供应链的不确定性与资本开支压力的双重挤压,促使头部团队主动承受迁移成本,加速推动本土算力链条的估值重构。
这场高额下注的真正考验在于工程落地的容错空间。几万颗芯片的互联通信、底层软件栈优化以及连续数月的训练稳定性,任何微小的短板都会被超大模型训练急剧放大。产业与市场资金都在屏息等待第四季度新芯片交付后,首轮大规模长周期训练给出的真实回测反馈。