优云智算
控制台
立即注册

Fish-Speech-S2-Pro-4B

Fish-Speech-S2-Pro-4B,接口api使用,支持62种语言,文本指令,文字转语音,声音克隆,zero-shot

镜像大小
90 GB
当前版本
v1.0
累计部署
112
累计运行
321 h
最近更新
2026-03-18

运行环境

框架版本
PyTorch-2.8
CUDA版本
2.8
应用
JupyterLab: 8888
支持卡型
RTX40系RTX50系
+3

Fish-Speech-S2-Pro-4B

  • 接口api使用,支持62种语言,文本指令,文字转语音,声音克隆,zero-shot

镜像简介

本镜像搭载Fish-Speech-S2-Pro-4B先进语音模型,提供标准API接口服务,支持62种语言的文字转语音、声纹识别与文本指令控制。适用于多语种内容创作、智能语音助手、声纹认证及全球化应用开发等场景,为用户提供高效且开箱即用的一站式语音AI解决方案。

镜像操作指南

1、该镜像支持自启动,初始化后,需要等待服务启动,大概2分钟左右,可以输入命令 tail -50f /root/wan/log.txt 查看启动日志

image.png image.png

2、随后点击 SD-WEBUI 按钮即可,上传音色文件或者选择音色,点击生成即可,支持批量任务

image.png

页面截图

PixPin_2026-03-15_11-42-10.png

支持接口调用

接口格式:http://你的实例ip/?text=测试测试,这里是测试&speaker=trump

0 个镜像 · 被使用 112
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
2026-03-15
评分
0.0
暂无评分
我的评分
未评分
Fish-Speech-S2-Pro-4B一键部署 | 优云智算