优云智算
控制台
立即注册

最好用的中文音频视频语音识别转文本字幕软件FunASR

将音频视频语音识别转为文本文件和SRT字幕文件

镜像大小
90 GB
当前版本
v1.0
累计部署
112
累计运行
366 h
最近更新
2026-02-02

运行环境

框架版本
PyTorch-2.8.0
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
RTX40系2080
+11

最好用的中文语音识别转文本字幕软件FunASR

软件可以批量将音频视频语音识别转换为文本文件和SRT字幕文件,中文识别效果优于其它同类软件,支持自定义热词,对于某些专业领域专有名词识别效果大大提升.

操作步骤

1、首先点击右侧蓝色按钮【使用该镜像创建实例】

image.png

2、选择合适的GPU型号,点击下方蓝色按钮【立即部署】

image.png

3、稍等一两分钟后实例便会运行,显示【运行中】后继续等待1分钟左右初始化,再点击右侧【SD-WebUI】按钮,即可打开WebUI操作界面

image.png

webui界面示例

image

注意

请尽量上传mp3,wav音频文件,上传mp4等视频文件可能会因为文件太大导致上传时间太长

AAI画师大阳认证作者
个人主页
0 个镜像 · 被使用 112
版本日志
v1.0最新
09-12
评分
0.0
暂无评分
我的评分
未评分