ComfyUI Node
RunningHub RVC One-Click Train
Runs the RVC training pipeline from a local training audio folder: preprocess, extract F0/features, train the model, and optionally build a FAISS index. The exported model and index are saved under ComfyUI output/RVC/<save_name>.
RunningHub RVC One-Click Train
- audio
- info
◄trainset_dir►
◄experiment_namervc_exp►
◄save_namervc_model►
◄versionv2►
◄sample_rate40k►
◄use_f0true►
◄f0_methodrmvpe►
◄speaker_id0►
◄total_epoch50►
◄save_every_epoch10►
◄batch_size4►
◄cpu_processes4►
◄is_halftrue►
◄train_indextrue►
◄pretrained_G►
◄pretrained_D►
◄save_latest_onlytrue►
◄cache_dataset_in_gpufalse►
◄save_every_weightsfalse►
◄audio_auto_cleantrue►
◄auto_extract_vocalstrue►
CategoryRunningHub/RVC
Inputs (22)
| Name | Type | Default | Description |
|---|---|---|---|
| trainset_dir | STRING | 训练音频目录。可填写绝对路径,或填写 ComfyUI input 目录下的相对目录;目录内放 wav/mp3/flac 等音频。 | |
| experiment_name | STRING | rvc_exp | 实验名。会用于 rvc_source/logs/<实验名> 存放训练日志和中间产物。 |
| save_name | STRING | rvc_model | 保存文件名。最终会在 ComfyUI output/RVC/<save_name>/ 下生成 <save_name>.pth、<save_name>.index 和 <save_name>.zip。 |
| version | COMBO | v2 | RVC 模型版本。v2 使用 768 维特征;v1 使用 256 维特征。 |
| sample_rate | COMBO | 40k | 训练采样率。40k 兼容性最好;48k 高频更完整但更吃资源;32k 仅 v2 常用。 |
| use_f0 | BOOLEAN | true | 是否训练带音高引导的模型。唱歌和保留旋律通常开启;纯说话可按需求关闭。 |
| f0_method | COMBO | rmvpe | 训练集音高提取算法。rmvpe 质量通常更好但需要 models/RVC/_assets/rmvpe/rmvpe.pt;harvest 稳定但较慢。 |
| speaker_id | INT | 00–999 | 写入训练 filelist 的说话人 ID。单人模型通常使用 0。 |
| total_epoch | INT | 501–1000 | 总训练轮数。小数据集常用 20-100;数据越多可适当增加。 |
| save_every_epoch | INT | 101–1000 | 每多少 epoch 保存一次 G/D checkpoint。 |
| batch_size | INT | 41–64 | 训练 batch size。显存不足时调小;调到 1 仍 OOM 时需要更大显存。 |
| cpu_processes | INT | 41–32 | 训练集预处理和部分 F0 提取使用的 CPU 进程数。 |
| is_half | BOOLEAN | true | 特征提取和训练是否启用半精度。CPU/MPS 环境或数值异常时关闭。 |
| train_index | BOOLEAN | true | 训练结束后是否基于特征构建 FAISS 检索索引。推理时 index_rate 大于 0 通常需要它。 |
| audioopt | * | 可选音频输入。trainset_dir 为空时使用;支持 ComfyUI AUDIO、AUDIO 列表、音频文件路径或路径列表。 | |
| pretrained_Gopt | STRING | 可选预训练 Generator 路径。留空会自动尝试 assets/pretrained(_v2) 下的默认文件;不存在则从头训练。 | |
| pretrained_Dopt | STRING | 可选预训练 Discriminator 路径。留空会自动尝试 assets/pretrained(_v2) 下的默认文件;不存在则从头训练。 | |
| save_latest_onlyopt | BOOLEAN | true | 是否只保留 latest G/D checkpoint。开启可减少磁盘占用。 |
| cache_dataset_in_gpuopt | BOOLEAN | false | 是否把训练集缓存进显存。10 分钟以下小数据可加速,大数据容易显存不足。 |
| save_every_weightsopt | BOOLEAN | false | 是否每次保存 checkpoint 时额外导出可推理的小模型。关闭时仍会在训练结束导出最终模型。 |
| audio_auto_cleanopt | BOOLEAN | true | 训练前自动清洗音频:转单声道、去静音、过滤过短/过低音量片段,并做峰值归一化。建议保持开启。 |
| auto_extract_vocalsopt | BOOLEAN | true | 训练前先用 Demucs/HDEMUCS 提取人声。仅在素材带伴奏时开启;干声训练集建议关闭以避免额外失真。 |
Outputs (1)
| Name | Type | Description |
|---|---|---|
| info | STRING | 训练流程日志摘要和生成文件位置。输出文件写入 ComfyUI output/RVC/<save_name>/。 |