Nodes/comfyui-t5gemma-tts/T5Gemma-TTS Generate
ComfyUI Node

T5Gemma-TTS Generate

Generate speech from text using T5Gemma-TTS. Supports multilingual TTS (EN/JA/ZH), voice cloning, and duration control.

By negaga53·Created 6 months ago·Updated 6 months ago· 0
T5Gemma-TTS Generate
  • model
  • reference_audio
  • audio
target_textHello, this is a test of the text to speech system.
top_k30
top_p0.90
temperature0.80
seed1
reference_text
target_duration0.0
languageauto
Categoryaudio/tts

Inputs (10)

NameTypeDefaultDescription
modelT5GEMMA_MODELT5Gemma-TTS model from the ModelLoader node
target_textSTRINGHello, this is a test of the text to speech system.Text to synthesize into speech
top_kINT301–200Top-k sampling parameter
top_pFLOAT0.900–1Top-p (nucleus) sampling parameter
temperatureFLOAT0.800.01–2Sampling temperature — lower = more deterministic
seedINT10–2147483647Random seed for reproducibility
reference_audiooptAUDIOReference audio for voice cloning (optional)
reference_textoptSTRINGTranscript of reference audio (leave blank to auto-transcribe via Whisper)
target_durationoptFLOAT0.00–120Target audio duration in seconds (0 = auto-estimate from text)
languageoptCOMBOautoLanguage of the target text (auto = detect automatically)

Outputs (1)

NameTypeDescription
audioAUDIO