优云智算
控制台
立即注册

新一代高质量语音生成模型VoxCPM 2.0 整合包升级了, 支持 30 种语言、9 种中文方言!

是 VoxCPM 系列的新一代语音生成模型,基于 2B 参数规模,并使用超过 200 万小时的多语言语音数据训练,支持 30 种语言、9 种中文方言

镜像大小
50 GB
当前版本
v1.0
累计部署
304
累计运行
845 h
最近更新
2026-06-19

运行环境

框架版本
PyTorch-2.9.1
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
2080Ti3090
+5

镜像名称

VoxCPM 2.0 新一代高质量语音生成模型,整合包升级了。

镜像简介

无需任何配置,一键运行,基于 2B 参数规模,并使用超过 200 万小时的多语言语音数据训练,支持 30 种语言、9 种中文方言,以及自然语言声音设计、可控声音克隆和高保真延续式克隆等能力。

配置方法

  1. 该镜像初始化后,需要等待服务启动,大概 3 分钟左右。
  2. 启动后点击按钮 “YZY启动器” 或者 “9000” 直接访问服务。
  3. 首次生成加载模型比较耗时。
  4. 服务运行日志查询,可以输入命令 tail -f /start.d/log/*
  5. 输出目录:/root/VoxCPM/outputs(可在浏览器中使用自带文件管理器访问) 云端YZY启动器.jpg 云端YZY启动器2.jpg

视频教程

详细步骤,可在 哔哩哔哩 余子越Talk 博主页面搜索 VoxCPM 观看视频教程!

相关链接

效果截图

云端.jpg 云端2.jpg

常见问题

0 个镜像 · 被使用 304
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
2026-06-19
评分
0.0
暂无评分
我的评分
未评分
新一代高质量语音生成模型VoxCPM 2.0 整合包升级了, 支持 30 种语言、9 种中文方言!一键部署 | 优云智算