优云智算
控制台
立即注册

人声增强,clearvoice,完全去除背景噪声,阿里达摩院语音实验室出品。

是目前综合最强最强的一个。提供语音增强、语音分离、语音超分辨率等能力,附带 SOTA 预训练模型。

镜像大小
40 GB
当前版本
v1.0
累计部署
140
累计运行
146 h
最近更新
2026-07-28

运行环境

框架版本
PyTorch-2.0.0
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
V100S3090
+4

镜像名称

人声增强,clearvoice,完全去除背景噪声,阿里达摩院语音实验室出品。

镜像简介

是目前效果最强的一个。提供语音增强、语音分离、语音超分辨率等能力,附带 SOTA 预训练模型。它的增强模型(MossFormer2_SE_48K)支持 48kHz,还带超分辨率功能,可以把有效采样率至少 16kHz 的低质量音频提升到 48kHz

配置方法

  1. 该镜像初始化后,需要等待服务启动,大概 3 分钟左右。
  2. 启动后点击按钮 “YZY启动器” 或者 “9000” 直接访问服务。
  3. 首次生成加载模型比较耗时。
  4. 服务运行日志查询,可以输入命令 tail -f /start.d/log/*
  5. 输出目录:可直接在生成页面下载。

视频教程

详细步骤,可在 哔哩哔哩 余子越Talk 博主页面搜索 人声增强clearvoice 观看视频教程!

相关链接

效果截图

云端.jpg

常见问题

0 个镜像 · 被使用 140
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
2026-07-28
评分
0.0
暂无评分
我的评分
未评分
人声增强,clearvoice,完全去除背景噪声,阿里达摩院语音实验室出品。一键部署 | 优云智算