觀點網訊:9月23日,千問正式發佈Qwen-Audio-3.1系列語音大模型。

本次升級對語音識別(ASR)、語音合成(TTS)和實時語音交互(Realtime)三大核心模型進行了進化,並推出全新的音頻創作模型Qwen-Audio-3.1-TTS-Next和音頻理解模型Qwen-Audio-3.1-ASR-Next。

五款全新的語音模型同時推出,形成了一套覆蓋“理解-生成-交互-創作”的完整音頻能力棧。

價格方面,Qwen-Audio全線語音模型價格均下調,其中TTS降價約70%,Realtime降幅約85%,ASR降幅達95%。