ComfyUI Node
Wan22 Sound Image To Video (Tiled VAE Encode)
A ComfyUI node in conditioning/video_models with 15 inputs and 3 outputs.
Wan22 Sound Image To Video (Tiled VAE Encode)
- positive
- negative
- vae
- audio_encoder_output
- ref_image
- control_video
- ref_motion
- positive
- negative
- latent
◄width832►
◄height480►
◄length77►
◄batch_size1►
◄tile_size512►
◄overlap64►
◄temporal_size64►
◄temporal_overlap8►
Categoryconditioning/video_models
Inputs (15)
| Name | Type | Default | Description |
|---|---|---|---|
| positive | CONDITIONING | — | |
| negative | CONDITIONING | — | |
| vae | VAE | — | |
| width | INT | 83216–16384 | — |
| height | INT | 48016–16384 | — |
| length | INT | 771–16384 | — |
| batch_size | INT | 11–4096 | — |
| tile_size | INT | 51264–4096 | — |
| overlap | INT | 640–4096 | — |
| temporal_size | INT | 648–4096 | Amount of frames to encode at a time. |
| temporal_overlap | INT | 84–4096 | Amount of frames to overlap. |
| audio_encoder_outputopt | AUDIO_ENCODER_OUTPUT | — | |
| ref_imageopt | IMAGE | — | |
| control_videoopt | IMAGE | — | |
| ref_motionopt | IMAGE | — |
Outputs (3)
| Name | Type | Description |
|---|---|---|
| positive | CONDITIONING | — |
| negative | CONDITIONING | — |
| latent | LATENT | — |