ComfyUI Node
Qwen3-ASR
Voice2Text: Convert audio to text.
Qwen3-ASR
- audio
- 文本
- 语言
- time_stamps
- time_stamps_json
◄max_inference_batch_size32►
◄max_new_tokens256►
◄model_choice1.7B►
◄deviceauto►
◄precisionbf16►
◄languageAuto►
◄forced_alignerfalse►
◄seed42►
CategoryQwen3-ASR
Inputs (9)
| Name | Type | Default | Description |
|---|---|---|---|
| audio | AUDIO | — | |
| max_inference_batch_size | INT | 32 | — |
| max_new_tokens | INT | 256 | — |
| model_choice | COMBO | 1.7B | 2 options: 0.6B, 1.7B |
| device | COMBO | auto | 4 options: auto, cuda, mps, cpu |
| precision | COMBO | bf16 | 2 options: bf16, fp32 |
| language | COMBO | Auto | 30 options: Auto, 中文, 英文, 粤语, 阿拉伯语, 德语, +24 |
| forced_aligner | BOOLEAN | false | — |
| seed | INT | 42 | — |
Outputs (4)
| Name | Type | Description |
|---|---|---|
| 文本 | STRING | — |
| 语言 | STRING | — |
| time_stamps | ANY | — |
| time_stamps_json | STRING | — |