优云智算
控制台
立即注册

VibeVoice:富有表现力的长篇多人对话语音合成工具

富有表现力的长篇多人对话语音合成工具

镜像大小
90 GB
当前版本
v2.0
累计部署
167
累计运行
736 h
最近更新
2026-01-30

运行环境

框架版本
PyTorch-2.8.0
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
3090RTX50系
+2

VibeVoice:富有表现力的长篇多人对话语音合成工具

镜像简介

  • VibeVoice可以合成非常自然逼真的长篇音频内容,同时可以合成对话,支持1-4个发音人,
  • 2.0版本支持上传音频文件自定义克隆声音,2.0使用的是7B模型

使用教程

1、首先点击右侧蓝色按钮【使用该镜像创建实例】

image.png

2、选择合适的GPU型号。然后点击下方蓝色按钮【立即部署】

image.png

3、稍等一两分钟后实例便会运行,显示【运行中】后请继续等待两三分钟左右初始化,再点击右侧【打开WebUI】按钮,即可打开WebUI操作界面

image.png

注意事项

软件只支持中英文语音合成

软件会随机合成一些背景乐,这是由场景决定的,如果想要删除,请修改出现背景乐处的文本内容

AAI画师大阳认证作者
个人主页
0 个镜像 · 被使用 167
版本日志
v2.0最新
11-13
VibeVoice 7B模型版
v1.0
11-12
评分
0.0
暂无评分
我的评分
未评分
VibeVoice:富有表现力的长篇多人对话语音合成工具一键部署 | 优云智算