Nodes/ComfyUI-VoxCPMTTS/VoxCPM TTS (Advanced)
ComfyUI Node

VoxCPM TTS (Advanced)

A ComfyUI node in 🧪AILab/🔊TTS/VoxCPMTTS with 16 inputs and 2 outputs.

By 1038lab·Created 11 months ago·Updated 8 months ago· 42
VoxCPM TTS (Advanced)
  • reference_audio
  • AUDIO
  • STRING
modelVoxCPM 1.5
textHello, this is VoxCPM TTS.
cfg_value2.0
inference_steps10
max_length4096
normalizetrue
reference_text
fade_in_ms20
auto_transcribe_referencefalse
show_transcription_logtrue
unload_modelfalse
retry_attempts2
retry_threshold8.0
deviceauto
seed-1
Category🧪AILab/🔊TTS/VoxCPMTTS

Inputs (16)

NameTypeDefaultDescription
modelCOMBOVoxCPM 1.5Select VoxCPM model version
textSTRINGHello, this is VoxCPM TTS.Text to synthesize into speech
cfg_valueFLOAT2.01–10Guidance scale: higher = more adherence to prompt, lower = more natural
inference_stepsINT101–100Number of diffusion steps: higher = better quality, lower = faster
max_lengthINT4096256–8192Maximum token length during generation
normalizeBOOLEANtrueEnable text normalization for numbers, punctuation, etc.
reference_audiooptAUDIOReference audio for voice cloning
reference_textoptSTRINGText transcript of reference audio (leave empty for auto-transcription)
fade_in_msoptINT200–1000Fade-in duration to reduce initial artifacts (0-1000ms)
auto_transcribe_referenceoptBOOLEANfalseAutomatically transcribe reference audio when no text is provided
show_transcription_logoptBOOLEANtrueShow ASR transcription logs in console
unload_modeloptBOOLEANfalseUnload model after generation to free VRAM
retry_attemptsoptINT20–10Number of retry attempts for bad cases
retry_thresholdoptFLOAT8.02–20Audio-to-text ratio threshold for retry detection
deviceoptCOMBOautoDevice to run the model on
seedoptINT-1-1–18446744073709550000Random seed (-1 for random)

Outputs (2)

NameTypeDescription
AUDIOAUDIO
STRINGSTRING