Según Wallstreetcn, el modelo nativo full-modal de próxima generación Qwen3.8-Omni-Flash de Alibaba Cloud se ha lanzado, con su objetivo central de mejorar las capacidades de los agentes en escenarios reales de productividad y de impulsar los modelos full-modal desde la comprensión de contenido multimodal hasta la planificación de tareas, la llamada de herramientas y la finalización de la creación. Basado en capacidades de agentes generales en programación, trabajo del conocimiento basado en texto y operaciones de GUI, Qwen3.8-Omni-Flash amplía aún más las aplicaciones de agentes centradas en audio y video, y ha mostrado resultados notables en flujos de trabajo que requieren el procesamiento integrado de texto, imágenes, audio y video, incluyendo la edición de video, la creación de videoclips musicales, la producción de cine y televisión y la narración, resúmenes de texto a partir de audio y video, y diálogos entre audio y video.