优云智算
控制台
立即注册
一键处理最强多说话人--音频分离--pyannote.audio工程
最强多说话人音频分离--pyannote.audio工程
star0
0/小时
v1.1
最新

镜像名称

一键处理,最强多说话人音频分离--pyannote.audio工程

镜像简介

  • 如果一段音频里面有多个说话人,现在想获取每个人的单独说话音频,这个镜像完美解决这个问题,效果非常惊艳!
  • 无需其他配置,一键处理

配置方法

  1. 该镜像初始化后,需要等待服务启动,大概 3 分钟左右。
  2. 启动后点击按钮 “YZY启动器” 或者 “9000” 直接访问服务。
  3. 首次生成加载模型比较耗时。
  4. 服务运行日志查询,可以输入命令 tail -f /start.d/log/*
  5. 输出目录:/root/audio_speaker_split/outputs,也可页面直接下载。

视频教程

详细步骤,可在 哔哩哔哩 余子越Talk 博主页面搜索 “多说话人音频分离pyannote-audio” 观看教程!

相关链接

效果截图

说话人分离1.jpg

说话人分离2.jpg

常见问题

  • 如果有背景音乐,可以使用clearvoice先去除背景音乐,我B站主页有教程和镜像链接
@余子越Talk
余子越Talk认证作者
镜像信息
已使用0
运行时长
0 H
支持自启动
镜像大小
40GB
最后更新时间
2026-08-05
支持卡型
3080Ti48G RTX40系RTX40系RTX50系3090V100S
+6
框架版本
PyTorch-2.8.0
CUDA版本
12.8
应用
JupyterLab: 8888
版本
v1.1
2026-08-05
PyTorch:2.8.0 | CUDA:12.8 | 大小:40.00GB
logo

隶属于优刻得科技股份有限公司

股票代码:688158

优刻得是中立、安全的云计算服务平台