Nodes/ComfyUI Kaola MOSS-TTS/Generates MOSS-TTS Speech
ComfyUI Node

Generates MOSS-TTS Speech

Generates speech using MOSS-TTS (Foundation). Supports zero-shot cloning if reference audio is provided.

By kana112233·Created 6 months ago·Updated 6 months ago· 3
Generates MOSS-TTS Speech
  • moss_tts_model
  • reference_audio
  • audio
textThe quick brown fox jumps over the lazy dog.
audio_temperature1.0
audio_top_p0.80
audio_top_k50
audio_repetition_penalty1.0
max_new_tokens2048
text_normalizetrue
instruction
CategoryKaola/MOSS-TTSD

Inputs (10)

NameTypeDefaultDescription
moss_tts_modelMOSS_TTS_MODELLoaded MOSS-TTS Foundation model.
textSTRINGThe quick brown fox jumps over the lazy dog.Text to narrate.
audio_temperatureFLOAT1.00.1–2Higher = more variation.
audio_top_pFLOAT0.800.1–1Nucleus sampling probability.
audio_top_kINT501–200Top-K sampling.
audio_repetition_penaltyFLOAT1.01–2Penalty for repeating audio tokens.
max_new_tokensINT2048100–10000Max audio tokens.
text_normalizeBOOLEANtrueNormalize text input.
reference_audiooptAUDIOReference audio for zero-shot cloning.
instructionoptSTRINGOptional instruction (if supported by model).

Outputs (1)

NameTypeDescription
audioAUDIO