ComfyUI Node
AIIA Dialogue TTS (Multi-Role)
A ComfyUI node in AIIA/Podcast with 25 inputs and 2 outputs.
AIIA Dialogue TTS (Multi-Role)
- speaker_A_ref
- speaker_B_ref
- speaker_C_ref
- cosyvoice_model
- vibevoice_model
- qwen_model
- full_audio
- segments_info
◄dialogue_json—►
◄tts_engineCosyVoice►
◄pause_duration0.5►
◄speed_global1.00►
◄batch_modeNatural (Hybrid)►
◄speaker_A_id►
◄speaker_A_emotionNone►
◄speaker_A_dialectNone►
◄speaker_B_id►
◄speaker_B_emotionNone►
◄speaker_B_dialectNone►
◄speaker_C_id►
◄speaker_C_emotionNone►
◄speaker_C_dialectNone►
◄max_batch_char1000►
◄cfg_scale1.5►
◄temperature0.80►
◄top_k20►
◄top_p0.95►
CategoryAIIA/Podcast
Inputs (25)
| Name | Type | Default | Description |
|---|---|---|---|
| dialogue_json | STRING | — | |
| tts_engine | COMBO | CosyVoice | 3 options: CosyVoice, VibeVoice, Qwen3-TTS |
| pause_duration | FLOAT | 0.50–5 | — |
| speed_global | FLOAT | 1.000.5–2 | — |
| batch_mode | COMBO | Natural (Hybrid) | 3 options: Natural (Hybrid), Strict (Per-Speaker), Whole (Single Batch) |
| speaker_A_refopt | AUDIO | — | |
| speaker_A_idopt | STRING | — | |
| speaker_A_emotionopt | COMBO | None | 44 options: None, Happy (开心), Sad (悲伤), Angry (愤怒), Excited (兴奋), Gentle (温柔), +38 |
| speaker_A_dialectopt | COMBO | None | 19 options: None, Mandarin (普通话), Cantonese (粤语), Shanghainese (上海话), Sichuanese (四川话), Northeastern (东北话), +13 |
| speaker_B_refopt | AUDIO | — | |
| speaker_B_idopt | STRING | — | |
| speaker_B_emotionopt | COMBO | None | 44 options: None, Happy (开心), Sad (悲伤), Angry (愤怒), Excited (兴奋), Gentle (温柔), +38 |
| speaker_B_dialectopt | COMBO | None | 19 options: None, Mandarin (普通话), Cantonese (粤语), Shanghainese (上海话), Sichuanese (四川话), Northeastern (东北话), +13 |
| speaker_C_refopt | AUDIO | — | |
| speaker_C_idopt | STRING | — | |
| speaker_C_emotionopt | COMBO | None | 44 options: None, Happy (开心), Sad (悲伤), Angry (愤怒), Excited (兴奋), Gentle (温柔), +38 |
| speaker_C_dialectopt | COMBO | None | 19 options: None, Mandarin (普通话), Cantonese (粤语), Shanghainese (上海话), Sichuanese (四川话), Northeastern (东北话), +13 |
| cosyvoice_modelopt | COSYVOICE_MODEL | — | |
| vibevoice_modelopt | VIBEVOICE_MODEL | — | |
| qwen_modelopt | QWEN_MODEL | — | |
| max_batch_charopt | INT | 1000100–32768 | — |
| cfg_scaleopt | FLOAT | 1.51–10 | — |
| temperatureopt | FLOAT | 0.800.1–2 | — |
| top_kopt | INT | 200–100 | — |
| top_popt | FLOAT | 0.950–1 | — |
Outputs (2)
| Name | Type | Description |
|---|---|---|
| full_audio | AUDIO | — |
| segments_info | STRING | — |