Nodes/ComfyUI_AIIA/CosyVoice 3.0 TTS (AIIA)
ComfyUI Node

CosyVoice 3.0 TTS (AIIA)

A ComfyUI node in AIIA/Synthesis with 12 inputs and 1 output.

By havvk·Created about a year ago·Updated 6 months ago· 12
CosyVoice 3.0 TTS (AIIA)
  • model
  • reference_audio
  • audio
prompt_label_1📖 第一步:在此输入您想让 AI 说的话 (TTS Text)
tts_text你好,这是 CosyVoice 3.0 的全能模式测试。
prompt_label_2🎨 第二步:在此输入对表现力/情感的文字描述 (Style Description)
instruct_text语速非常慢,语气充满磁性,情感饱满。
base_genderFemale
dialectNone (Auto)
emotionNone (Neutral)
spk_id
speed1.0
seed42
CategoryAIIA/Synthesis

Inputs (12)

NameTypeDefaultDescription
modelCOSYVOICE_MODEL
prompt_label_1STRING📖 第一步:在此输入您想让 AI 说的话 (TTS Text)
tts_textSTRING你好,这是 CosyVoice 3.0 的全能模式测试。
prompt_label_2STRING🎨 第二步:在此输入对表现力/情感的文字描述 (Style Description)
instruct_textSTRING语速非常慢,语气充满磁性,情感饱满。文字描述:在 0.5B 中主要控制情感、方言、语速等'表现风格',而非从零生成音色身份。
base_genderCOMBOFemale基础性别底色。在“描述生成”模式下,这提供初始的声音身份(性别/音感底色)。
dialectCOMBONone (Auto)预设方言指令。会自动添加在自定义描述之前。若与自定义文字描述冲突,模型表现将不可预测。
emotionCOMBONone (Neutral)预设情感指令。会自动添加在自定义描述之前。
spk_idSTRING固定音色 ID (如 pure_1)。对于 0.5B/V3 等 Zero-Shot 模型,此项通常为空,需配合参考音频使用。
speedFLOAT1.00.5–2
seedINT42-1–2147483647
reference_audiooptAUDIO

Outputs (1)

NameTypeDescription
audioAUDIO