千問新語音模型登頂盲測榜,AI配音開始會笑會生氣
MMetaEra
阿里釋出了新的AI配音模型Qwen-Audio-3.0-TTS。該模型能按要求控制情緒、語速和角色,並能加入笑聲、抽氣、咳嗽和嘆氣等細節。使用者只需輸入“憤怒地說”或“說到一半笑出來”等指令,模型即可執行。
與過去僅能順暢朗讀的AI配音不同,Qwen-Audio-3.0-TTS開始能理解並執行“導演要求”。其Plus版支援16種語言和20種中文方言,最高可生成48kHz音訊,並能在有噪聲的參考錄音中提取音色進行聲音克隆。
在Artificial Analysis的第三方語音盲測中,Qwen-Audio-3.0-TTS Plus版排名第一。
[MetaEra]