ComfyUI Node

TextEncodeReferenceImages

Encodes text with reference images for VL models and conditioning.

By sebagallo·Created 7 months ago·Updated 5 months ago· 0
TextEncodeReferenceImages
  • clip
  • vae
  • image_encoder
  • images
  • CONDITIONING
prompt
vl_selectionnone
auto_resize_imagestrue
Categoryconditioning

Inputs (7)

NameTypeDefaultDescription
clipCLIPThe CLIP model to use for encoding.
promptSTRINGThe text prompt to encode.
vl_selectionCOMBOnoneSelect the Vision-Language model strategy.
auto_resize_imagesBOOLEANtrueAutomatically resize reference images to 1024x1024.
vaeoptVAEVAE for encoding reference images into latents.
image_encoderoptCLIP_VISIONCLIP Vision model for encoding reference images.
imagesoptIMAGEReference images to be used for conditioning (supports image batches).

Outputs (1)

NameTypeDescription
CONDITIONINGCONDITIONING