优云智算
控制台
立即注册

F5-TTS

F5-TTS 是由上海交通大学、剑桥大学和吉利汽车于 2024 年共同开源的一款高性能文本到语音系统,它基于流匹配的非自回归生成方法,结合了扩散变换器技术。

镜像大小
70 GB
当前版本
v1.0
累计部署
65
累计运行
322 h
最近更新
2026-04-27

运行环境

框架版本
PyTorch-2.0
CUDA版本
12.4
应用
JupyterLab: 8888
支持卡型
RTX40系2080
+10

F5-TTS 极速3秒克隆声音 支持大模型对话模式

镜像由科哥构建 微信:312088415

镜像使用教程

该镜像已经设置开机运行

1. 一切环境已经就绪,开机已经启动应用,待实例初始化完成后,等待1-2分钟即可打开webUI进入使用页面:

image

进入使用页面为如下画面:

image

2. 如果需要重启程序,进入jupyterlab,终端命令行中输入:

cd /root && run.sh

并回车,等待1-2分钟即可打开webUI进入使用页面.

官方更新源码在这里: https://github.com/SWivid/F5-TTS
使用视频及教程参考:B站搜索“F5-tts”相关视频教程
使用教程更新地址:https://kege-aigc.feishu.cn/docx/G5G1dcRUForkdnxhuQLcmsuknTb


有bug请微信科哥: 312088415 科哥目前在研究AI数字人直播卖货很成功,欢迎来了解一起玩: https://kege-aigc.feishu.cn/docx/G271dgZr1o8CvMx9KKrcRuuonDf

科哥在UCLoud的镜像列表【不断更新中】: https://kege-aigc.feishu.cn/docx/L3FVdQl7kom8Ckx7QiicQj2VnEd

鸡你太美认证作者
个人主页
0 个镜像 · 被使用 65
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
05-26
F5-TTS 是由上海交通大学、剑桥大学和吉利汽车研究院(宁波)有限公司于 2024 年共同开源的一款高性能文本到语音 (TTS) 系统, 它基于流匹配的非自回归生成方法,结合了扩散变换器 (DiT) 技术。 1、一切环境已经就绪,开机已经启动应用,等待1-2分钟即可打开webUI进入使用页面: 2、如果需要重启程序,进入jupyterlab,终端命令行中输入: cd /root && run.sh 并回车,等待1-2分钟即可打开webUI进入使用页面. 官方更新源码在这里: https://github.com/SWivid/F5-TTS 使用视频及教程参考:B站搜索“F5-tts”相关视频教程 使用教程更新地址:https://kege-aigc.feishu.cn/docx/G5G1dcRUForkdnxhuQLcmsuknTb --- 有bug请微信科哥: 312088415 科哥目前在研究AI数字人直播卖货很成功,欢迎来了解一起玩: https://kege-aigc.feishu.cn/docx/G271dgZr1o8CvMx9KKrcRuuonDf
评分
0.0
暂无评分
我的评分
未评分
F5-TTS一键部署 | 优云智算