Nodes/ComfyUI_RH_RVC/RunningHub RVC Voice Conversion
ComfyUI Node

RunningHub RVC Voice Conversion

Converts a ComfyUI AUDIO input with a loaded RVC model. The node returns ComfyUI AUDIO and the RVC runtime log; use ComfyUI audio save nodes for files.

By RH-RunningHub·Created 3 months ago·Updated 3 months ago· 0
RunningHub RVC Voice Conversion
  • rvc_model
  • audio
  • audio
  • info
speaker_id0
f0_up_key0
f0_methodharvest
index_path
index_rate0.66
filter_radius3
resample_sr0
rms_mix_rate1.00
protect0.33
CategoryRunningHub/RVC

Inputs (11)

NameTypeDefaultDescription
rvc_modelRVC_MODEL由 RunningHub RVC Model Loader 输出的已加载模型。
audioAUDIOComfyUI AUDIO 输入。请先用 LoadAudio、音频裁剪或音频分离节点接入音频。
speaker_idINT00–999目标说话人 ID。单说话人模型通常为 0,多说话人模型按训练时的 ID 选择。
f0_up_keyINT0-24–24升降调半音数。正数升调,负数降调,0 保持原调。
f0_methodCOMBOharvestF0 提取算法。harvest 稳定但较慢;pm 较快;rmvpe 通常质量更好但需要 models/RVC/_assets/rmvpe/rmvpe.pt。
index_pathSTRING可选 .index 文件路径。留空时会按模型名在 logs 和 assets/indices 下自动查找;没有 index 时仍可转换。
index_rateFLOAT0.660–1检索特征混合比例。值越高越贴近目标音色,但可能带来咬字或噪声问题。
filter_radiusINT30–7F0 中值滤波半径。大于 0 可减少毛刺,通常 3 即可。
resample_srINT00–48000输出重采样率。0 表示使用模型原始采样率;设置为 16000 以上会重采样输出。
rms_mix_rateFLOAT1.000–1响度包络混合比例。1 更保留输入响度,0 更接近目标模型响度。
protectFLOAT0.330–0.5辅音和呼吸声保护强度。数值越大越保护原音,音色转换程度会降低。

Outputs (2)

NameTypeDescription
audioAUDIO转换后的 ComfyUI AUDIO,可继续连接到音频保存、视频合成或后处理节点。
infoSTRINGRVC 推理日志,包含模型、设备、index 使用情况和耗时信息。