IT之家 12 月 10 日消息,阿里通義千問今日發布 Qwen3-TTS,這是一款支持多音色、多語種和多方言的語音合成 AI 模型,目前可通過 Qwen API 訪問。
IT之家附 Qwen3-TTS 主要改進內容如下:
- 更加豐富的音色支持:Qwen3-TTS 提供超過 49 種音色,涵蓋不同性別、年齡、地域特徵與角色設定,包括撒嬌搞怪-茉兔、青梅竹馬-小野杏、傲嬌率性的女漢子-十三、嚴厲老師-墨講師、智慧老者-滄明子、蘿莉萌妹-萌小姬等角色。
- 多語種多方言能力持續增強:Qwen3-TTS 支持中文、英文、德語、義大利語、葡萄牙語、西班牙語、日語、韓語、法語、俄語等 10 大主流語言,在 MiniMax TTS multilingual test set 上,平均詞錯誤率(WER)優於 MiniMax、ElevenLabs 及 GPT-4o-Audio-Preview;支持更多音色的方言生成,包括普通話、閩南語、吳語、粵語、四川話、北京話、南京話、天津話和陝西話,還原地方口音特色與語言神韻。
- 韻律 / 語速更加自然,更擬人化:相比於上一個版本,Qwen3-TTS 自適應根據文本調節語速和韻律的能力大幅提高,官方宣稱擬人化程度逼近真人。