ComfyUI Node
RunningHub RVC Voice Conversion
Converts a ComfyUI AUDIO input with a loaded RVC model. The node returns ComfyUI AUDIO and the RVC runtime log; use ComfyUI audio save nodes for files.
RunningHub RVC Voice Conversion
- rvc_model
- audio
- audio
- info
◄speaker_id0►
◄f0_up_key0►
◄f0_methodharvest►
◄index_path►
◄index_rate0.66►
◄filter_radius3►
◄resample_sr0►
◄rms_mix_rate1.00►
◄protect0.33►
CategoryRunningHub/RVC
Inputs (11)
| Name | Type | Default | Description |
|---|---|---|---|
| rvc_model | RVC_MODEL | 由 RunningHub RVC Model Loader 输出的已加载模型。 | |
| audio | AUDIO | ComfyUI AUDIO 输入。请先用 LoadAudio、音频裁剪或音频分离节点接入音频。 | |
| speaker_id | INT | 00–999 | 目标说话人 ID。单说话人模型通常为 0,多说话人模型按训练时的 ID 选择。 |
| f0_up_key | INT | 0-24–24 | 升降调半音数。正数升调,负数降调,0 保持原调。 |
| f0_method | COMBO | harvest | F0 提取算法。harvest 稳定但较慢;pm 较快;rmvpe 通常质量更好但需要 models/RVC/_assets/rmvpe/rmvpe.pt。 |
| index_path | STRING | 可选 .index 文件路径。留空时会按模型名在 logs 和 assets/indices 下自动查找;没有 index 时仍可转换。 | |
| index_rate | FLOAT | 0.660–1 | 检索特征混合比例。值越高越贴近目标音色,但可能带来咬字或噪声问题。 |
| filter_radius | INT | 30–7 | F0 中值滤波半径。大于 0 可减少毛刺,通常 3 即可。 |
| resample_sr | INT | 00–48000 | 输出重采样率。0 表示使用模型原始采样率;设置为 16000 以上会重采样输出。 |
| rms_mix_rate | FLOAT | 1.000–1 | 响度包络混合比例。1 更保留输入响度,0 更接近目标模型响度。 |
| protect | FLOAT | 0.330–0.5 | 辅音和呼吸声保护强度。数值越大越保护原音,音色转换程度会降低。 |
Outputs (2)
| Name | Type | Description |
|---|---|---|
| audio | AUDIO | 转换后的 ComfyUI AUDIO,可继续连接到音频保存、视频合成或后处理节点。 |
| info | STRING | RVC 推理日志,包含模型、设备、index 使用情况和耗时信息。 |