Theo Wallstreetcn, mô hình native full-modal thế hệ tiếp theo Qwen3.8-Omni-Flash của Alibaba Cloud đã ra mắt. Mục tiêu cốt lõi của mô hình là nâng cao năng lực tác nhân trong các kịch bản năng suất thực tế, đồng thời thúc đẩy các mô hình full-modal từ việc hiểu nội dung đa phương thức sang lập kế hoạch các tác vụ, gọi công cụ và hoàn tất quá trình tạo lập. Được xây dựng dựa trên các năng lực tác nhân tổng quát trong lập trình, công việc tri thức dựa trên văn bản và thao tác với GUI, Qwen3.8-Omni-Flash tiếp tục mở rộng các ứng dụng tác nhân tập trung vào âm thanh và video. Mô hình cũng đã cho thấy kết quả đáng chú ý trong các quy trình cần xử lý tích hợp văn bản, hình ảnh, âm thanh và video, bao gồm chỉnh sửa video, tạo video âm nhạc, sản xuất phim và truyền hình cùng lồng tiếng, tóm tắt dạng văn bản-hình ảnh từ âm thanh và video, và hội thoại giữa âm thanh và video.