Reflection выпустила модель с открытыми весами Beam: 501 млрд параметров всего, из них активируются 23 млрд. Компания утверждает, что модель сравнялась с GLM-5.2 на продвинутых тестах на рассуждение, используя для инференса в 3–4 раза меньше вычислительных ресурсов, чем конкуренты.

Эти цифры получены на собственных тестах компании и пока не прошли независимую проверку. В основе модели — архитектура смеси экспертов: общее число параметров велико, но при каждом инференсе активируется лишь небольшая их часть, поэтому отдельный запрос обходится дешевле. Обратите внимание: речь об экономии вычислительных ресурсов при инференсе; на этапе обучения применялось интенсивное обучение с подкреплением, требующее больших вычислительных мощностей.