H3
镜像社区
部署GPU实例
模型与Agent
MiniMax H3
价格
桌面客户端
文档中心
控制台
立即注册
镜像社区
>
镜像详情
AI应用
语音识别
音频视频语音识别转文本字幕faster-whisper 1.2
将音频或视频文件语音识别转为文本文件或字幕文件
镜像大小
100 GB
当前版本
v1.2
累计部署
269 次
累计运行
3,598 h
最近更新
2026-02-02
运行环境
运行环境
框架版本
PyTorch-2.7.1
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
RTX40系
2080
+10
音频视频语音识别转文本及字幕
镜像简介
可以将mp3,wav音频文件或是mp4视频文件的语音识别转为文本或是字幕文件,基于当前最新模型,启用字级时间戳,识别效果快速准确。
使用教程
1、首先点击右侧蓝色按钮【使用该镜像创建实例】
2、选择合适的GPU,点击下方蓝色按钮【立即部署】
3、稍等一两分钟后实例便会运行,显示【运行中】后继续等待1分钟左右初始化,再点击右侧【SD-WebUI】按钮,即可打开WebUI操作界面
软件操作比较简单,按WebUI界面提示操作即可
A
AI画师大阳
认证作者
个人主页
0 个镜像 · 被使用 269 次
使用该镜像创建实例
☆ 收藏 23
分享
版本日志
v1.2
最新
2025-09-03
更新faster-whisper至最新1.2版本
评分
0.0
暂无评分
我的评分
★
★
★
★
★
未评分
提交评分
相关镜像
Crawl4AI:基于AI的网络爬虫和数据抓取工具
20 部署 · 27h
PDFMathTranslate-next基于 AI 完整保留排版的 PDF 文档全文双语翻译
83 部署 · 1,730h
FlashVSR 视频高清放大工具
485 部署 · 904h
VibeVoice:富有表现力的长篇多人对话语音合成工具
167 部署 · 736h
InfiniteTalk数字人视频制作软件,图片转视频,视频人物配音
590 部署 · 872h
Copyright © 2025 沪ICP备12020087号-61
音频视频语音识别转文本字幕faster-whisper 1.2一键部署 | 优云智算