Alibabas Tongyi Qianwen hat die Qwen-Audio-3.1-Serie veröffentlicht und führt damit fünf neue Sprachmodelle ein, die einen vollständigen Audio-Stack bilden und Verstehen, Generierung, Interaktion sowie Kreation abdecken. Das Upgrade umfasst weiterentwickelte Kernmodelle für Spracherkennung, Sprachsynthese und Echtzeit-Interaktion sowie neue TTS-Next- und ASR-Next-Varianten. Die Preise für die gesamte Qwen-Audio-Produktreihe wurden deutlich gesenkt, um die Kosten für die Nutzer zu reduzieren. Die Preise für Text-to-Speech sanken um etwa 70 %, die Gebühren für Echtzeit-Sprachinteraktion fielen um rund 85 %, und die Kosten für die automatische Spracherkennung wurden um bis zu 95 % gekürzt.