News brief
正文
Meta今日在GitHub上正式开源了最新一代语音合成模型VoiceX。该模型参数量为30亿,支持50种语言的零样本语音克隆,仅需3秒音频即可生成高度逼真的目标音色。VoiceX在情感表达和韵律控制上表现优异,MOS达到4.6。Meta表示,此举旨在打破语音AI的技术壁垒,推动全球开发者构建更具包容性的无障碍应用。
News brief
Meta今日在GitHub上正式开源了最新一代语音合成模型VoiceX。该模型参数量为30亿,支持50种语言的零样本语音克隆,仅需3秒音频即可生成高度逼真的目标音色。VoiceX在情感表达和韵律控制上表现优异,MOS达到4.6。Meta表示,此举旨在打破语音AI的技术壁垒,推动全球开发者构建更具包容性的无障碍应用。