Qianwen publie Qwen-Audio-3.1 et baisse les prix sur toute la gamme des modèles de parole Qwen-Audio
Qianwen lance officiellement la série de grands modèles vocaux Qwen-Audio-3.1. Cette mise à niveau améliore de manière complète trois modèles essentiels : la reconnaissance vocale (ASR), la synthèse vocale (TTS) et l’interaction vocale en temps réel (Realtime). Elle introduit également, de manière très remarquée, de nouveaux modèles de création audio : Qwen-Audio-3.1-TTS-Next, ainsi qu’un nouveau modèle de compréhension audio : Qwen-Audio-3.1-ASR-Next. Cinq nouveaux modèles vocaux sont lancés en même temps, formant un ensemble complet de capacités audio couvrant « compréhension - génération - interaction - création ». Afin de réduire davantage les coûts d’utilisation pour les utilisateurs, les prix des modèles vocaux Qwen-Audio sur l’ensemble de la gamme ont tous été revus à la baisse : le TTS baisse d’environ 70 %, le Realtime d’environ 85 % et l’ASR atteint une baisse de 95 %.
Qianwen lance officiellement la série de grands modèles vocaux Qwen-Audio-3.1. Cette mise à niveau améliore de manière complète trois modèles essentiels : la reconnaissance vocale (ASR), la synthèse vocale (TTS) et l’interaction vocale en temps réel (Realtime). Elle introduit également, de manière très remarquée, de nouveaux modèles de création audio : Qwen-Audio-3.1-TTS-Next, ainsi qu’un nouveau modèle de compréhension audio : Qwen-Audio-3.1-ASR-Next. Cinq nouveaux modèles vocaux sont lancés en même temps, formant un ensemble complet de capacités audio couvrant « compréhension - génération - interaction - création ». Afin de réduire davantage les coûts d’utilisation pour les utilisateurs, les prix des modèles vocaux Qwen-Audio sur l’ensemble de la gamme ont tous été revus à la baisse : le TTS baisse d’environ 70 %, le Realtime d’environ 85 % et l’ASR atteint une baisse de 95 %.
