ComfyUI Node

Index TTS 2.5

A ComfyUI node in audio with 21 inputs and 3 outputs.

By mailzwj·Created 12 days ago·Updated 11 days ago· 3
Index TTS 2.5
  • reference_audio
  • emo_ref_audio
  • audio
  • seed
  • subtitle
text你好,欢迎使用 IndexTTS 2.5 语音合成。
languagezh
duration_factor1.00
seed0
emo_alpha1.00
emo_vector
emo_text
use_emo_textfalse
use_qwen_emofalse
use_randomfalse
do_sampletrue
temperature0.80
top_p0.80
top_k30
repetition_penalty10.0
length_penalty0.0
num_beams3
max_mel_tokens1500
use_bf16true
Categoryaudio

Inputs (21)

NameTypeDefaultDescription
textSTRING你好,欢迎使用 IndexTTS 2.5 语音合成。
reference_audioAUDIO
languageCOMBOzh5 options: zh, en, ja, es, ar
duration_factorFLOAT1.000.5–2
seedINT00–4294967295
emo_ref_audiooptAUDIO情感参考音频:用一段带目标情绪的语音引导合成情感。 提供 emo_vector 或 emo_text 后此输入会被忽略。
emo_alphaoptFLOAT1.000–1情感强度(0~1):对 emo_vector 做整体缩放; 或控制情感参考音频与说话人音色的混合比例。
emo_vectoroptSTRING8 维情感向量,顺序固定:高兴/愤怒/悲伤/恐惧/反感/低落/惊讶/自然。 逗号分隔或 JSON 数组,如 0.8,0,0,0,0,0,0,0 或 [0,0,0,0,0,0,0,1](自然)。 必须恰好 8 个数字,否则忽略;提供后覆盖 emo_ref_audio。
emo_textoptSTRING情感文本:用自然语言描述情绪(如「高兴」「悲伤」「愤怒」),由 QwenEmotion 自动转为情感向量。 非空即自动启用,需 qwen0.6bemo4-merge 模型;提供后覆盖 emo_ref_audio。
use_emo_textoptBOOLEANfalse使用情感文本。emo_text 非空时自动启用,无需单独勾选。
use_qwen_emooptBOOLEANfalse加载 QwenEmotion 情感模型(仅情感文本需要;使用 emo_text 时自动加载)。
use_randomoptBOOLEANfalse随机情感:随机挑选情感参考向量(需同时提供 emo_vector 或 emo_text 才生效)。
do_sampleoptBOOLEANtrue
temperatureoptFLOAT0.800.1–2
top_poptFLOAT0.800–1
top_koptINT300–100
repetition_penaltyoptFLOAT10.01–15
length_penaltyoptFLOAT0.0-2–2
num_beamsoptINT31–10
max_mel_tokensoptINT150050–1815
use_bf16optBOOLEANtrue

Outputs (3)

NameTypeDescription
audioAUDIO
seedINT
subtitleSTRING