Nodes/ComfyUI-MiniMaxH3Audio/MiniMax H3 Text to Audio
ComfyUI Node

MiniMax H3 Text to Audio

MiniMax H3 の音声ストリームだけを実用コストで生成するための conditioning + AV latent。video は最小 7:4 キャンバスに縮め、デコードはコア VAEDecodeAudio を使います。

By t22m003·Created 14 days ago·Updated 14 days ago· 0
MiniMax H3 Text to Audio
  • clip
  • positive
  • latent
prompt
seconds15.00
video_canvas224x128
Categoryaudio/minimax_h3

Inputs (4)

NameTypeDefaultDescription
clipCLIP
promptSTRINGH3 T2VA 形式のプロンプト(MiniMaxH3AudioPrompt の出力を推奨)
secondsFLOAT15.005.16–150目標尺(秒)。24fps の 17k+5 グリッドへ切り上げ。最小実尺は 124f≈5.17s。15.1s 超は学習範囲外・experimental
video_canvasCOMBO224x128ダミー video キャンバス(1344×768 と同アスペクト 7:4 推奨。既定は較正勝者)

Outputs (2)

NameTypeDescription
positiveCONDITIONING
latentLATENT