ComfyUI Node
Vision Prompt Helper
A ComfyUI node in prompt with 11 inputs and 2 outputs.
Vision Prompt Helper
- image_1
- image_2
- vision_prompt
- debug_info
◄intent►
◄modeOutfit Transfer►
◄engineollama►
◄base_urlhttp://localhost:11434►
◄model[ollama] qwen3-vl:8b►
◄temperature0.7►
◄jpeg_quality85►
◄max_edge1280►
◄custom_system_prompt►
Categoryprompt
Inputs (11)
| Name | Type | Default | Description |
|---|---|---|---|
| intent | STRING | — | |
| mode | COMBO | Outfit Transfer | 15 options: Outfit Transfer, Hair Change, Body Reshape, Background Change, Pose Change, Combined Edit, +9 |
| engine | COMBO | ollama | ollama: local Ollama server (no API key needed) vllm: local OpenAI-compatible server (vLLM, sglang, LM Studio, ...) openai: ChatGPT — needs OPENAI_API_KEY claude: Anthropic via OpenRouter — needs OPENROUTER_API_KEY gemini: Google Gemini — needs GEMINI_API_KEY |
| base_url | COMBO | http://localhost:11434 | 5 options: http://localhost:11434, http://localhost:8000/v1, https://api.openai.com/v1, https://openrouter.ai/api/v1, https://generativelanguage.googleapis.com/v1beta/openai/ |
| model | COMBO | [ollama] qwen3-vl:8b | 6 options: [ollama] gemma2:2b, [ollama] llama3.2:3b, [ollama] qwen3-vl:32b, [ollama] qwen3-vl:8b, [vllm] Qwen/Qwen2.5-7B-Instruct, [vllm] Qwen/Qwen2.5-VL-7B-Instruct |
| temperature | FLOAT | 0.70–2 | — |
| jpeg_quality | INT | 8560–95 | — |
| max_edge | INT | 1280512–2048 | — |
| image_1 | IMAGE | — | |
| image_2opt | IMAGE | — | |
| custom_system_promptopt | STRING | — |
Outputs (2)
| Name | Type | Description |
|---|---|---|
| vision_prompt | STRING | — |
| debug_info | STRING | — |