优云智算
控制台
立即注册

OmniVoice,接口api使用,支持600种语言,4G显存可用,速度1比0.3,文本指令,支持呻吟笑声,文字转语音,支持超长文本,声音克隆,小米k2-fsa团队开源

OmniVoice,接口api使用,支持600种语言,4G显存可用,速度1比0.3,文本指令,支持呻吟笑声,文字转语音,支持超长文本,声音克隆,小米k2-fsa团队开源

镜像大小
40 GB
当前版本
v1.0
累计部署
232
累计运行
736 h
最近更新
2026-04-05

运行环境

框架版本
PyTorch-2.8
CUDA版本
2.8
应用
JupyterLab: 8888
支持卡型
RTX40系RTX50系
+5

OmniVoice,接口api使用,支持600种语言,4G显存可用,速度1比0.3,文本指令,支持呻吟笑声,文字转语音,支持超长文本,声音克隆,小米k2-fsa团队开源

镜像简介

1、该镜像支持自启动,初始化后,需要等待服务启动,大概2分钟左右,可以输入命令 tail -50f /root/wan/log.txt 查看启动日志

2、随后点击 SD-WEBUI 按钮即可,上传音色文件或者选择音色,点击生成即可,支持批量任务

PixPin_2026-04-05_20-56-24.png

3 支持接口api请求

接口格式:http://你的实例ip:8188/?text=测试测试,这里是测试&speaker=叶奈法

其他参数 instruct=女,河南话,少年 speed=0.8 lang=en novasr=1

PixPin_2026-04-05_20-57-02.png

刘悦的技术博客认证作者
个人主页
0 个镜像 · 被使用 232
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
04-05
评分
0.0
暂无评分
我的评分
未评分
OmniVoice,接口api使用,支持600种语言,4G显存可用,速度1比0.3,文本指令,支持呻吟笑声,文字转语音,支持超长文本,声音克隆,小米k2-fsa团队开源一键部署 | 优云智算