El equipo de Alibaba Qwen lanzará el miércoles Qwen 3.8-Flash-Next, un modelo mixture-of-experts con 125 mil millones de parámetros totales y 6 mil millones activados por token. Según ChainCatcher, el equipo dijo que el modelo es una vista previa de la próxima arquitectura Qwen 4, en lugar de su modelo insignia final.

El modelo se describe como multimodal y está construido sobre la próxima arquitectura Qwen 4. Según ChainCatcher, el lanzamiento anticipado tiene como objetivo ayudar a los desarrolladores a prepararse para la serie completa de Qwen, y los pesos del modelo se alojarán en Hugging Face y ModelScope.

Qwen aún no ha publicado resultados de evaluaciones comparativas ni datos de comparación con su serie Qwen 3 o competidores extranjeros, y las cifras de 125 mil millones y 6 mil millones de parámetros no han sido confirmadas oficialmente. Como modelo de pesos abiertos, se puede descargar, ajustar y ejecutar sin enviar datos a una API cerrada, lo que puede reducir los costos de alojamiento para los desarrolladores.