优云智算
控制台
立即注册

VoxCPM2 一键切片打标训练集准备&训练生成一体化镜像

集成 VoxCPM2 一键切片、自动打标、训练集整理、LoRA 训练与生成推理,开箱即用的全流程声音克隆训练镜像。

镜像大小
50 GB
当前版本
v1.0
累计部署
42
累计运行
37 h
最近更新
2026-04-19

运行环境

框架版本
PyTorch-12.8
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
RTX50系

使用前,请先将你的原始长音频替换到 /workspace/datasets/raw_media/speaker1.wav,并保持文件名 speaker1.wav 不变。

执行以下命令:

bash /mnt/data/run_voxcpm_prepare_only.sh

即可自动完成一键切片、中文 ASR 自动打标以及训练清单生成。

全部处理结束后,点击 SD-WebUI 进入训练界面,即可开始后续训练与生成。

相关文档:https://pan.quark.cn/s/cee8509df856

镜像使用指南

教学视频:

0 个镜像 · 被使用 42
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
2026-04-18
评分
0.0
暂无评分
我的评分
未评分