镜像名称
一键处理,最强多说话人音频分离--pyannote.audio工程
镜像简介
- 如果一段音频里面有多个说话人,现在想获取每个人的单独说话音频,这个镜像完美解决这个问题,效果非常惊艳!
- 无需其他配置,一键处理
配置方法
- 该镜像初始化后,需要等待服务启动,大概 3 分钟左右。
- 启动后点击按钮 “YZY启动器” 或者 “9000” 直接访问服务。
- 首次生成加载模型比较耗时。
- 服务运行日志查询,可以输入命令 tail -f /start.d/log/*
- 输出目录:/root/audio_speaker_split/outputs,也可页面直接下载。
视频教程
详细步骤,可在 哔哩哔哩 余子越Talk 博主页面搜索 “多说话人音频分离pyannote-audio” 观看教程!
相关链接
效果截图


常见问题
- 如果有背景音乐,可以使用clearvoice先去除背景音乐,我B站主页有教程和镜像链接