Nodes/Higgs v3 TTS/Higgs v3 Whisper Transcribe
ComfyUI Node

Higgs v3 Whisper Transcribe

Transcribe reference AUDIO with Whisper for Higgs v3 voice cloning.

By Saganaki22·Created 2 months ago·Updated 2 months ago· 64
Higgs v3 Whisper Transcribe
  • audio
  • transcript
modelwhisper-large-v3-turbo (auto-download)
dtypeauto
languageauto
tasktranscribe
chunk_length_s30
download_if_missingtrue
CategoryHiggs v3 TTS

Inputs (7)

NameTypeDefaultDescription
audioAUDIOReference audio to transcribe for Higgs v3 reference_text.
modelCOMBOwhisper-large-v3-turbo (auto-download)Whisper ASR model. Turbo is fast and usually accurate enough for reference transcripts.
dtypeCOMBOautoWhisper precision. auto uses bf16 on supported CUDA/XPU and fp32 otherwise.
languageCOMBOautoReference audio language. auto detects it; setting it can improve transcript accuracy.
taskCOMBOtranscribetranscribe keeps the original language; translate outputs English.
chunk_length_sINT300–120Whisper chunk length for longer reference clips. 0 lets Transformers choose.
download_if_missingBOOLEANtrueDownload the selected Whisper model into ComfyUI/models/audio_encoders if it is missing.

Outputs (1)

NameTypeDescription
transcriptSTRING