国产大模型四大金刚,强得可怕,都走出了自己的路

每家各自在一个维度上做到了极致,都找到了自己的护城河。

1、Kimi:预训练之神
月之暗面把参数拉到了 2.8 万亿,能力仅次于 Fable5,是目前国产模型里上限最高的。营收超过 2000 万美金,但合作需要分成,靠技术溢价赚钱,不靠低价抢市场。2.8 万亿参数放到全球看也是第一梯队,Kimi 在参数规模和预训练数据质量上都砸了重金。

2、DeepSeek:成本效率之神
同等价格无敌手,被行业称为斩杀线。别的模型定价高于 DeepSeek 基本就没活路,10 个月硬件回本,涨价后估计三个月就能回本。DeepSeek 用 MoE 架构把推理成本压到极致,同样的 token 价格别人亏钱它赚钱,整个行业都在看它的定价来调整策略。

3、GLM:后训练之神
智谱走了一条完全不同的路。底模 GLM5 训练的小版本,每一代更比一代强,小版本升级效果堪比大版本。参数只有 7000 多亿,智能程度达到了 Opus 4.8。同样的底模别人训 70 分,GLM 能训到 90 分,后训练的技术壁垒比堆参数更难复制,这里面积累的是 know-how,砸钱解决不了。

4、MiniMax:多模态视频之神
前三个都在语言模型赛道卷,MiniMax 直接换了赛道。开源视频模型拉到了全新高度,多模态能力是四家里最突出的。视频生成才刚开始,市场空间可能比语言模型更大,不在红海里拼刺刀,去蓝海里建壁垒,这个策略很聪明。

国产大模型已经过了全面对标 GPT 的阶段,开始分化了。最后能赢的,是在自己生态位上做到不可替代的那家。