ComfyUI Node
CSM Text-to-Speech with Context
A ComfyUI node in zveroboy/CSM with 11 inputs and 1 output.
CSM Text-to-Speech with Context
- audio_context
- audio
◄text—►
◄model_path—►
◄tokenizer_path—►
◄sample_rate24000►
◄context_transcription—►
◄context_speaker0►
◄speaker0►
◄max_audio_length_ms90000.00►
◄temperature0.70►
◄topk100►
Categoryzveroboy/CSM
Inputs (11)
| Name | Type | Default | Description |
|---|---|---|---|
| text | STRING | — | |
| model_path | STRING | — | |
| tokenizer_path | STRING | — | |
| sample_rate | INT | 240008000–48000 | — |
| audio_context | AUDIO | — | |
| context_transcription | STRING | — | |
| context_speaker | INT | 00–10 | — |
| speakeropt | INT | 00–10 | — |
| max_audio_length_msopt | FLOAT | 90000.001000–300000 | — |
| temperatureopt | FLOAT | 0.700.1–2 | — |
| topkopt | INT | 1001–200 | — |
Outputs (1)
| Name | Type | Description |
|---|---|---|
| audio | AUDIO | — |