#OpenAIReportedlyCompletesBelModelPretraining was Zhipu AI mit GLM-5.3 hingelegt hat, ist unglaublich
mit demselben Basismodell wie GLM-5.2, aber allein durch das Skalieren des Post-Trainings sprang seine DeepSWE-Punktzahl von 44 → 69
ich verstehe immer noch nicht, wie allein das Post-Training es so nah an die Leistung von Fable 5 gebracht hat, während es nur einen Bruchteil der Kosten verursachte und ein viel kleineres Modell ist$WIF $MET $PROM
mit demselben Basismodell wie GLM-5.2, aber allein durch das Skalieren des Post-Trainings sprang seine DeepSWE-Punktzahl von 44 → 69
ich verstehe immer noch nicht, wie allein das Post-Training es so nah an die Leistung von Fable 5 gebracht hat, während es nur einen Bruchteil der Kosten verursachte und ein viel kleineres Modell ist$WIF $MET $PROM