Reflection 发布开源权重模型 Beam:5010 亿总参数、激活 230 亿,称在高级推理基准上追平 GLM-5.2,推理算力只用对手的 1/3 到 1/4。
这些数字来自公司自己的基准,还没独立验证。机制在混合专家:总参数大,但每次推理只激活一小部分,所以单次调用更省。注意,这里的“省算力”对标的是推理;训练阶段用的是高算力强化学习。
这些数字来自公司自己的基准,还没独立验证。机制在混合专家:总参数大,但每次推理只激活一小部分,所以单次调用更省。注意,这里的“省算力”对标的是推理;训练阶段用的是高算力强化学习。