智谱 lanza el modelo GLM-5.3, que muestra un mejor rendimiento en codificación compleja y tareas de larga duración
El 14 de agosto, Zhipu (02513.HK) anunció que hoy lanza el GLM-5.3. Utiliza el mismo modelo base que el GLM-5.2: todas las mejoras de rendimiento provienen de optimizaciones posteriores al entrenamiento. En comparación con el GLM-5.2, ofrece un mejor desempeño en codificación compleja y tareas de larga duración. El GLM-5.3 cuenta con una capacidad de codificación más sólida; es, en la actualidad, el modelo de pesos de código abierto con más funcionalidades. En nuestras pruebas internas de referencia de código Z.ai, su rendimiento mejora en un 50% frente al GLM-5.2. Además, cuando se despliega a gran escala después de finalizar el entrenamiento, su evolución en capacidades de red supera nuestras expectativas. En la plataforma CyberGym, el GLM-5.3 lidera en el descubrimiento de vulnerabilidades, y su mejora es especialmente notable en la fase final de las cadenas de explotación: en las pruebas de referencia de explotación, su rendimiento es más del doble que el del GLM-5.2. Una vez completadas la evaluación de seguridad y las tareas de fortalecimiento, publicaremos los pesos dos semanas después del lanzamiento.
El 14 de agosto, Zhipu (02513.HK) anunció que hoy lanza el GLM-5.3. Utiliza el mismo modelo base que el GLM-5.2: todas las mejoras de rendimiento provienen de optimizaciones posteriores al entrenamiento. En comparación con el GLM-5.2, ofrece un mejor desempeño en codificación compleja y tareas de larga duración. El GLM-5.3 cuenta con una capacidad de codificación más sólida; es, en la actualidad, el modelo de pesos de código abierto con más funcionalidades. En nuestras pruebas internas de referencia de código Z.ai, su rendimiento mejora en un 50% frente al GLM-5.2. Además, cuando se despliega a gran escala después de finalizar el entrenamiento, su evolución en capacidades de red supera nuestras expectativas. En la plataforma CyberGym, el GLM-5.3 lidera en el descubrimiento de vulnerabilidades, y su mejora es especialmente notable en la fase final de las cadenas de explotación: en las pruebas de referencia de explotación, su rendimiento es más del doble que el del GLM-5.2. Una vez completadas la evaluación de seguridad y las tareas de fortalecimiento, publicaremos los pesos dos semanas después del lanzamiento.
