Подразделение Alibaba Tongyi Qianwen выпустило серию Qwen-Audio-3.1, представив пять новых голосовых моделей, которые образуют полноценный аудиостек, охватывающий понимание, генерацию, взаимодействие и создание контента. Обновление включает усовершенствованные базовые модели для распознавания речи, синтеза и взаимодействия в реальном времени, а также новые варианты TTS-Next и ASR-Next. Цены на всю линейку Qwen-Audio были существенно снижены, чтобы сократить расходы пользователей. Стоимость синтеза речи (text-to-speech) упала примерно на 70%, тарифы на голосовое взаимодействие в реальном времени снизились приблизительно на 85%, а затраты на автоматическое распознавание речи сократились на целых 95%.