Zhipu AI gab bekannt, dass es GLM-5.3-Flash gestartet und als Open Source veröffentlicht hat – das erste native Multimodal-Modell in seiner GLM-5-Serie. Laut Odaily sagte das Unternehmen, dass das Modell insgesamt GLM-5.2 übertrifft, bei Coding- und Agent-Benchmarks nahe an Claude Opus 4.8 heranreicht und nur ein Zehntel so viel kostet wie GLM-5.2.

Zhipu AI sagte, dass GLM-5.3-Flash ein neues Basismodell verwendet, erstmals in der GLM-Hauptserie eine hybride Sparse-Attention- und Linear-Attention-Architektur einführt und auf 30T Token multimodaler Daten vortrainiert wurde. Das Unternehmen sagte außerdem, es habe das Modell vor der offiziellen Veröffentlichung anonym als „Ox-Alpha“ auf OpenCode und OpenRouter getestet, um Nutzerfeedback zu sammeln.

Zhipu AI sagte, Ox-Alpha sei in dieser Woche das beliebteste Modell geworden und habe einen neuen Höchststand für Anrufe auf beiden Plattformen erreicht; sämtliche Anfragen wurden von inländischen Chips unterstützt. Das Unternehmen erklärte zuvor, dass Community-Tests von Ox Alpha auf DeepSWE kurzzeitig ein Ergebnis von 80 % auf Basis von 10 Fragen gezeigt hätten, der Wert jedoch nach Ausweitung der Stichprobengröße auf etwa 63 % gefallen sei. Außerdem hieß es, Entwickler könnten die Open-Source-Gewichte nun direkt mit Frameworks wie vLLM, SGLang und KTransformers bereitstellen, ohne die anonyme Modell-API zu nutzen.