H3
镜像社区
部署GPU实例
模型与Agent
MiniMax H3
价格
桌面客户端
文档中心
控制台
立即注册
镜像社区
>
镜像详情
支持自启动
语音合成
VibeVoice:富有表现力的长篇多人对话语音合成工具
富有表现力的长篇多人对话语音合成工具
镜像大小
90 GB
当前版本
v2.0
累计部署
167 次
累计运行
736 h
最近更新
2026-01-30
运行环境
运行环境
框架版本
PyTorch-2.8.0
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
3090
RTX50系
+2
VibeVoice:富有表现力的长篇多人对话语音合成工具
镜像简介
VibeVoice可以合成非常自然逼真的长篇音频内容,同时可以合成对话,支持1-4个发音人,
2.0版本支持上传音频文件自定义克隆声音,2.0使用的是7B模型
使用教程
1、首先点击右侧蓝色按钮【使用该镜像创建实例】
2、选择合适的GPU型号。然后点击下方蓝色按钮【立即部署】
3、稍等一两分钟后实例便会运行,显示【运行中】后请继续等待两三分钟左右初始化,再点击右侧【打开WebUI】按钮,即可打开WebUI操作界面
注意事项
软件只支持中英文语音合成
软件会随机合成一些背景乐,这是由场景决定的,如果想要删除,请修改出现背景乐处的文本内容
A
AI画师大阳
认证作者
个人主页
0 个镜像 · 被使用 167 次
使用该镜像创建实例
☆ 收藏 14
分享
版本日志
v2.0
最新
11-13
VibeVoice 7B模型版
v1.0
11-12
评分
0.0
暂无评分
我的评分
★
★
★
★
★
未评分
提交评分
相关镜像
Crawl4AI:基于AI的网络爬虫和数据抓取工具
20 部署 · 27h
PDFMathTranslate-next基于 AI 完整保留排版的 PDF 文档全文双语翻译
83 部署 · 1,730h
FlashVSR 视频高清放大工具
476 部署 · 904h
InfiniteTalk数字人视频制作软件,图片转视频,视频人物配音
589 部署 · 869h
Qwen-Image-Edit-2509多图编辑及人物一致性生成
176 部署 · 193h
Copyright © 2025 沪ICP备12020087号-61
VibeVoice:富有表现力的长篇多人对话语音合成工具一键部署 | 优云智算