优云智算
控制台
立即注册

FunASR在线语音识别/语音生成 二次开发构建by科哥

来自阿里开源 科哥二次构建开发webui

镜像大小
50 GB
当前版本
v1.0
累计部署
40
累计运行
78 h
最近更新
2026-04-27

运行环境

框架版本
PyTorch-2.4
CUDA版本
12.4
应用
JupyterLab: 8888
支持卡型
RTX40系2080
+10

FunASR在线语音识别/语音生成

镜像简介

FunASR 是一款基础语音识别工具包,提供多种功能,包括语音识别 (ASR)、语音活动检测 (VAD)、标点符号恢复、语言模型、说话人验证、说话人分类和多说话人自动语音识别 (ASR)。FunASR 提供​​便捷的脚本和教程,支持对预训练模型进行推理和微调。

镜像使用教程

1、选择镜像和版本

image.png

2、选择GPU进行部署,推荐选择4090

image.png

3、实例启动后,先进入jupyterlab,在jupyterlab中运行启动器

image.png

4、运行 启动器

image.png image.png

5、.返回控制面板 打开sd-webui

image.png

打开sd-webui

image

6、sd-webui运行使用界面截图

image.png

image.png

image.png

image.png

7、更多高级指令,可以进入jupyterlab,自行操作,例如:

查看进程:

ps -ef |grep python

终止进程:

kill -9 pid

bug反馈可以加入科哥专属群交流!

描述图片内容

有bug请微信科哥: 312088415

科哥在UCloud镜像列表【不断更新中】:

image.png

鸡你太美认证作者
个人主页
0 个镜像 · 被使用 40
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
09-17
语音生成文本 webui开机自动运行
评分
0.0
暂无评分
我的评分
未评分
FunASR在线语音识别/语音生成 二次开发构建by科哥一键部署 | 优云智算