Nodes/ComfyUI_Simple_Qwen3-VL-gguf/Simple Qwen-VL Vision Language Model
ComfyUI Node

Simple Qwen-VL Vision Language Model

A ComfyUI node in 🌐 SimpleQwenVL with 14 inputs and 4 outputs.

By KLL535Β·Created 9 months agoΒ·Updated about a month agoΒ· 80
Simple Qwen-VL Vision Language Model
  • image
  • image2
  • image3
  • audio
  • video
  • text
  • conditioning
  • system_prompt
  • user_prompt
β—„model_presetNoneβ–Ί
β—„system_presetNoneβ–Ί
β—„user_promptDescribe this image.β–Ί
β—„seed42β–Ί
β—„unload_all_modelsfalseβ–Ί
β—„modesubprocessβ–Ί
β—„system_prompt_overrideβ€”β–Ί
β—„config_overrideβ€”β–Ί
β—„variablesβ€”β–Ί
Category🌐 SimpleQwenVL

Inputs (14)

NameTypeDefaultDescription
model_presetCOMBONone1 options: None
system_presetCOMBONone66 options: None, πŸ–ΌοΈ Tags, πŸ–ΌοΈ Simple Description, πŸ–ΌοΈ Detailed Description, πŸ–ΌοΈ Ultra Detailed Description, 🎬 Cinematic Description, +60
user_promptSTRINGDescribe this image.β€”
seedINT42β€”
unload_all_modelsBOOLEANfalseβ€”
modeCOMBOsubprocess6 options: subprocess, direct_clean, keep_vram, save1, save2, save3
imageoptIMAGEβ€”
image2optIMAGEβ€”
image3optIMAGEβ€”
audiooptAUDIOβ€”
videoopt*β€”
system_prompt_overrideoptSTRINGβ€”
config_overrideoptSTRINGβ€”
variablesoptSTRINGβ€”

Outputs (4)

NameTypeDescription
textSTRINGβ€”
conditioningCONDITIONINGβ€”
system_promptSTRINGβ€”
user_promptSTRINGβ€”