Nodes/Qwen2.5-VL GGUF Nodes/🖼️ Vision Model Loader (Transformers)
ComfyUI Node

🖼️ Vision Model Loader (Transformers)

A ComfyUI node in 🤖 GGUF-VLM/🖼️ Vision Models with 6 inputs and 1 output.

By walke2019·Created 9 months ago·Updated 8 months ago· 29
🖼️ Vision Model Loader (Transformers)
    • model_config
    modelHuihui-Qwen3-VL-4B-Instruct-abliterated
    quantizationnone
    attentionflash_attention_2
    keep_model_loadedfalse
    min_pixels200704
    max_pixels1003520
    Category🤖 GGUF-VLM/🖼️ Vision Models

    Inputs (6)

    NameTypeDefaultDescription
    modelCOMBOHuihui-Qwen3-VL-4B-Instruct-abliterated选择 Qwen3-VL Abliterated 模型
    quantizationCOMBOnone量化类型
    attentionCOMBOflash_attention_2注意力机制实现(Qwen3-VL 推荐: flash_attention_2)
    keep_model_loadedBOOLEANfalse推理后是否保持模型加载在内存中
    min_pixelsINT2007043136–12845056最小像素数
    max_pixelsINT10035203136–12845056最大像素数

    Outputs (1)

    NameTypeDescription
    model_configTRANSFORMERS_MODEL