最强大的VoxCPM节点,支持多人配音、支持训练lora(包含数据集准备节点,傻瓜式操作)、兼容老模型
全网 最强大 最好用 功能最全面 的voxcpm工作流
这是一个专为 ComfyUI 设计的 VoxCPM 语音合成与训练工具包。它集成了音频生成、声音克隆、数据集准备和 LoRA 微调训练等一站式功能。
除了voxcpm2 也兼容了voxcpm0.5B和voxcpm1.5的老版本使用
通过原生且动态的 ComfyUI 节点界面,您可以轻松实现从单人配音到多角色对话的复杂音频工作流,并支持对模型进行定制化微调,训练lora。
[spk1]、[ctrl])即可生成带情感控制的多人对话。train.jsonl 数据集,内置自动静音切片和 FunASR 文本识别。
这是音频生成的核心节点,融合了目前所有的推理能力。
核心模式:
多人配音语法示例:
在“目标文本”框中输入:
[ctrl]非常兴奋,大声地
[spk1] 欢迎使用 VoxCPM 节点!
[ctrl]低沉,平缓
[spk2] 这是一个多人对话演示。
[spk] 旁白也可以没有特定角色。
lora训练说明 10分钟的训练数据大概训练两到三千步即可