优云智算
控制台
立即注册
复旦出品asr模型-最强语音转录文字 MOSS-Transcribe-Diarize 0.9B 模型
复旦出品asr模型-最强语音转录文字 MOSS-Transcribe-Diarize 0.9B 模型,一键生成字幕
star0
0/小时
v1.0
最新

镜像名称

语音转文字模型asr:MOSI 的 MOSS-Transcribe-Diarize-0.9B 开源了,目前准确率第一的!

镜像简介

  • 在一段多人聊天、互相抢话、声音叠在一起的音频里,
  • 它能一次性把谁说了什么、什么时候说的,全给你标出来。
  • 128K 上下文。最长约 90 分钟的音频可以一次喂进去,不用切段。

配置方法

  1. 该镜像初始化后,需要等待服务启动,大概 3 分钟左右。
  2. 启动后点击按钮 “YZY启动器” 或者 “9000” 直接访问服务。
  3. 首次生成加载模型比较耗时。
  4. 服务运行日志查询,可以输入命令 tail -f /start.d/log/*
  5. 输出目录: /root/moss-td/runs/xxx/

视频教程

详细步骤,可在 哔哩哔哩 余子越Talk 博主页面搜索 语音转录文字 MOSS-Transcribe-Diarize 观看视频教程!

相关链接

效果截图

云端.jpg

常见问题

@余子越Talk
余子越Talk认证作者
镜像信息
已使用1
运行时长
0 H
支持自启动
镜像大小
60GB
最后更新时间
2026-07-22
支持卡型
3080TiRTX50系RTX40系48G RTX40系2080Ti30902080V100S
+8
框架版本
PyTorch-2.0.0
CUDA版本
12.8
应用
JupyterLab: 8888
版本
v1.0
2026-07-22
PyTorch:2.0.0 | CUDA:12.8 | 大小:60.00GB
logo

隶属于优刻得科技股份有限公司

股票代码:688158

优刻得是中立、安全的云计算服务平台

复旦出品asr模型-最强语音转录文字 MOSS-Transcribe-Diarize 0.9B 模型一键部署 | 优云智算