A Tongyi Qianwen, da Alibaba, lançou a série Qwen-Audio-3.1, apresentando cinco novos modelos de voz que formam uma stack completa de áudio, abrangendo compreensão, geração, interação e criação. A atualização inclui modelos centrais aprimorados para reconhecimento de fala, síntese e interação em tempo real, além das novas variantes TTS-Next e ASR-Next. Os preços de toda a linha Qwen-Audio foram significativamente reduzidos para diminuir os custos dos usuários. O valor da conversão de texto em fala caiu aproximadamente 70%, as taxas de interação por voz em tempo real caíram cerca de 85% e os custos do reconhecimento automático de fala foram reduzidos em até 95%.