Nodes/comfyui-ts-cosyvoice/TS CosyVoice Voice To Voice
ComfyUI Node

TS CosyVoice Voice To Voice

Convert source audio to sound like the target voice (voice-to-voice).

By AlexYez·Created 4 months ago·Updated 13 days ago· 3
TS CosyVoice Voice To Voice
  • model
  • source_audio
  • target_audio
  • audio
speed1.00
pitch_shift_semitones0
seed42
diffusion_steps10
guidance_strength0.70
normalize_outputfalse
target_rms_dbfs-20.0
CategoryTS CosyVoice3/Synthesis

Inputs (10)

NameTypeDefaultDescription
modelCOSYVOICE_MODELЗагруженная модель CosyVoice из ноды загрузчика.
source_audioAUDIOИсходное аудио, которое нужно преобразовать в другой тембр.
target_audioAUDIOРеференс целевого голоса; будет обрезан до 30 секунд и приведен к оптимальному формату.
speedFLOAT1.000.5–2Множитель скорости итоговой речи.
pitch_shift_semitonesINT0-12–12Сдвиг высоты тона исходного аудио в полутонах перед voice conversion.
seedoptINT42-1–2147483647Зерно случайности; значение -1 использует случайный seed.
diffusion_stepsoptINT104–60Число шагов флоу-декодера. 10 — значение модели по умолчанию (быстро); 25–40 даёт больше деталей и пропорционально дольше считает.
guidance_strengthoptFLOAT0.700–1.5Сила classifier-free guidance. 0.7 — значение из конфигурации модели; выше — ближе к референсу, но растёт риск артефактов.
normalize_outputoptBOOLEANfalseПриводит громкость результата к целевому уровню RMS, чтобы разные референсы давали сопоставимую громкость.
target_rms_dbfsoptFLOAT-20.0-40–-6Целевой уровень RMS в dBFS при включённой нормализации. Это RMS, а не LUFS: пики ограничиваются -1 dBFS.

Outputs (1)

NameTypeDescription
audioAUDIO