De acordo com a Wallstreetcn, o modelo nativo full-modal de próxima geração da Alibaba Cloud, Qwen3.8-Omni-Flash, foi lançado com o objetivo central de aprimorar as capacidades de agentes em cenários reais de produtividade e levar modelos full-modal da compreensão de conteúdo multimodal ao planejamento de tarefas, à chamada de ferramentas e à conclusão da criação. Construído sobre capacidades gerais de agentes em programação, trabalho do conhecimento baseado em texto e operações de interface gráfica (GUI), o Qwen3.8-Omni-Flash expande ainda mais aplicações agenticas centradas em áudio e vídeo e apresentou resultados notáveis em fluxos de trabalho que exigem processamento integrado de texto, imagens, áudio e vídeo, incluindo edição de vídeo, criação de videoclipe musical, produção de cinema e televisão e narração, resumos de texto-imagem a partir de áudio e vídeo, além de diálogos de áudio e vídeo.