ComfyUI Node
MiniMax H3 Text to Audio
MiniMax H3 の音声ストリームだけを実用コストで生成するための conditioning + AV latent。video は最小 7:4 キャンバスに縮め、デコードはコア VAEDecodeAudio を使います。
MiniMax H3 Text to Audio
- clip
- positive
- latent
◄prompt►
◄seconds15.00►
◄video_canvas224x128►
Categoryaudio/minimax_h3
Inputs (4)
| Name | Type | Default | Description |
|---|---|---|---|
| clip | CLIP | — | |
| prompt | STRING | H3 T2VA 形式のプロンプト(MiniMaxH3AudioPrompt の出力を推奨) | |
| seconds | FLOAT | 15.005.16–150 | 目標尺(秒)。24fps の 17k+5 グリッドへ切り上げ。最小実尺は 124f≈5.17s。15.1s 超は学習範囲外・experimental |
| video_canvas | COMBO | 224x128 | ダミー video キャンバス(1344×768 と同アスペクト 7:4 推奨。既定は較正勝者) |
Outputs (2)
| Name | Type | Description |
|---|---|---|
| positive | CONDITIONING | — |
| latent | LATENT | — |