优云智算
控制台
立即注册

VoxCPM-来自面壁智能和清华的语音生成模型

几秒音频即可克隆声音 构建by科哥

镜像大小
40 GB
当前版本
v1.0
累计部署
26
累计运行
64 h
最近更新
2026-04-27

运行环境

框架版本
PyTorch-2.4
CUDA版本
12.4
应用
JupyterLab: 8888
支持卡型
RTX40系2080
+10

VoxCPM-来自面壁智能和清华的语音生成模型

模型介绍:

VoxCPM是面壁智能于2025年9月18日发布的0.5B参数尺寸开源语音生成基座模型,该模型在语音合成的自然度、音色相似度和韵律表现力方面达到SOTA水平,能够通过少量数据克隆特定音色。其技术支持根据文本内容自动匹配合适的声音类型与情感基调,实现智能化的语音生成。模型参数规模为0.5B,在保持轻量化的同时实现高质量的语音输出。

使用教程

1、选择本镜像创建实例,推荐选择4090 GPU进行部署 image.png image.png

2、实例创建后等待2分钟,选择SD-WebUI打开

image

WebUI运行使用界面截图

image.png

image.png

image.png

bug反馈可以加入科哥专属群交流!

描述图片内容

有bug请微信科哥: 312088415


科哥在UCloud镜像列表【不断更新中】:

image.png

鸡你太美认证作者
个人主页
0 个镜像 · 被使用 26
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
09-20
二次开发修改webui 更加容易操作
评分
0.0
暂无评分
我的评分
未评分
VoxCPM-来自面壁智能和清华的语音生成模型一键部署 | 优云智算