Пекинский Qianwen выпускает Qwen-Audio-3.1, снижая цены на всю линейку голосовых моделей Qwen-Audio
Компания Qianwen официально представила серию Qwen-Audio-3.1 — голосовую модель большого размера. На этот раз обновление не только полностью модернизировало три ключевые модели — распознавание речи (ASR), синтез речи (TTS) и интерактивное реальное время (Realtime), но и с особым акцентом представило новую модель для аудиосоздания Qwen-Audio-3.1-TTS-Next и модель для аудиопонимания Qwen-Audio-3.1-ASR-Next. Одновременно выходят пять новых голосовых моделей, формируя целый стек аудиоспособностей, охватывающий «понимание-генерацию-взаимодействие-создание». Чтобы дополнительно снизить затраты пользователей на использование, цены на голосовые модели Qwen-Audio по всей линейке были снижены: TTS — примерно на 70%, Realtime — примерно на 85%, а ASR — на 95%.
Компания Qianwen официально представила серию Qwen-Audio-3.1 — голосовую модель большого размера. На этот раз обновление не только полностью модернизировало три ключевые модели — распознавание речи (ASR), синтез речи (TTS) и интерактивное реальное время (Realtime), но и с особым акцентом представило новую модель для аудиосоздания Qwen-Audio-3.1-TTS-Next и модель для аудиопонимания Qwen-Audio-3.1-ASR-Next. Одновременно выходят пять новых голосовых моделей, формируя целый стек аудиоспособностей, охватывающий «понимание-генерацию-взаимодействие-создание». Чтобы дополнительно снизить затраты пользователей на использование, цены на голосовые модели Qwen-Audio по всей линейке были снижены: TTS — примерно на 70%, Realtime — примерно на 85%, а ASR — на 95%.
