El Tongyi Qianwen de Alibaba ha lanzado la serie Qwen-Audio-3.1, presentando cinco nuevos modelos de voz que conforman una pila de audio completa que abarca comprensión, generación, interacción y creación. La actualización incluye modelos fundamentales evolucionados para el reconocimiento de voz, la síntesis y la interacción en tiempo real, junto con nuevas variantes TTS-Next y ASR-Next. Los precios de toda la línea Qwen-Audio se han reducido significativamente para disminuir los costos para los usuarios. El precio de texto a voz cayó aproximadamente un 70%, las tarifas de interacción de voz en tiempo real bajaron alrededor de un 85% y los costos de reconocimiento automático del habla se redujeron hasta un 95%.