Stepping Star veröffentlicht Step 3.7 Flash: 198B Parameter MoE großes Modell, fokussiert auf produktionsfähige Agenten
Stepping Star hat offiziell das neue Flash große Modell Step 3.7 Flash veröffentlicht und Open Source bereitgestellt, unter der Apache 2.0 Lizenz. Das Modell verwendet einen 196B Sprachkern + 1.8B visuelle Transformer, um eine spärliche MoE-Architektur zu bilden, mit insgesamt 198B Parametern und nur 11B aktivierten. Es unterstützt 256K Kontext und 3 Stufen Inferenz, optimiert für produktionsfähige Agenten, Code, vernetzte Suche und multimodale Workflows.
Warum das wichtig ist: Das KI-Team aus China hat im Bereich der Open Source multimodalen MoE großen Modelle einen bedeutenden Durchbruch erzielt, das Design mit niedrigen aktivierten Parametern + hoher Fähigkeitsdichte repräsentiert die industrielle Richtung für effiziente Inferenz.
#AI #开源 #大模型 #MoE #KünstlicheIntelligenz