Suno 开源的全能音频生成模型,支持语音、音乐、音效与环境声的联合生成。
Project story
Bark 是 Suno 开源的生成式音频模型:由文本直接生成自然语音,并能在同一声轨中混入音乐、音效与笑声(如「[laughs]」标记),生成的语音带情感与停顿,接近真人演绎。
支持多语言、语音克隆与声音预设,本地可运行;虽然以语音为主,但它统一了语音-音乐-音效的生成范式,影响了一批后续音频模型。
适合场景:有声内容、带音效的口播、短视频音频素材创作。
上手方式:pip install bark 后按文档用提示词生成带情感与音效的语音。