ComfyUI Node: ThinkingLLM Prompt Enhancer (GGUF)
Run ComfyUI workflows without the setup
No installs, no CUDA version roulette, no GPU sitting idle on your bill. Bring a workflow and run it in the browser.
Category
ThinkingLLM
Inputs
model_name
- Goekdeniz-Guelmez.Josiefied-Qwen3-4B-Instruct-2507-gabliterated-v1.Q4_K_M.gguf [~2.4GB]
- Goekdeniz-Guelmez.Josiefied-Qwen3-4B-Instruct-2507-gabliterated-v1.Q5_K_M.gguf [~2.8GB]
- Goekdeniz-Guelmez.Josiefied-Qwen3-4B-Instruct-2507-gabliterated-v1.Q6_K.gguf [~3.2GB]
- Goekdeniz-Guelmez.Josiefied-Qwen3-4B-Instruct-2507-gabliterated-v1.Q8_0.gguf [~4.2GB]
- Goekdeniz-Guelmez.Josiefied-Qwen3-4B-Instruct-2507-gabliterated-v1.f16.gguf [~8GB]
- Josiefied-Qwen3-4B-abliterated-v1.Q4_K_M.gguf [~2.4GB]
- Josiefied-Qwen3-4B-abliterated-v1.Q5_K_M.gguf [~2.8GB]
- Josiefied-Qwen3-4B-abliterated-v1.Q6_K.gguf [~3.2GB]
- Josiefied-Qwen3-4B-abliterated-v1.Q8_0.gguf [~4.2GB]
- Josiefied-Qwen3-4B-abliterated-v1.f16.gguf [~8GB]
- Josiefied-Qwen3-8B-abliterated-v1.Q4_K_M.gguf [~5.3GB]
- Josiefied-Qwen3-8B-abliterated-v1.Q5_K_M.gguf [~6.5GB]
- Josiefied-Qwen3-8B-abliterated-v1.Q6_K.gguf [~7.5GB]
- Josiefied-Qwen3-8B-abliterated-v1.Q8_0.gguf [~9GB]
- Josiefied-Qwen3-8B-abliterated-v1.f16.gguf [~16GB]
- Qwen3-4B-Q4_K_M.gguf [~2.4GB]
- Qwen3-4B-Q5_K_M.gguf [~2.8GB]
- Qwen3-4B-Q6_K.gguf [~3.2GB]
- Qwen3-4B-Q8_0.gguf [~4.2GB]
- Qwen3-4B-abliterated.Q4_K_M.gguf [~2.4GB]
- Qwen3-4B-abliterated.Q5_K_M.gguf [~2.8GB]
- Qwen3-4B-abliterated.Q6_K.gguf [~3.2GB]
- Qwen3-4B-abliterated.Q8_0.gguf [~4.2GB]
- Qwen3-4B-abliterated.f16.gguf [~8GB]
- Qwen3-VL-4B-Instruct-c_abliterated-v2.Q4_K_M.gguf [~2.4GB]
- Qwen3-VL-4B-Instruct-c_abliterated-v2.Q5_K_M.gguf [~2.8GB]
- Qwen3-VL-4B-Instruct-c_abliterated-v2.Q6_K.gguf [~3.2GB]
- Qwen3-VL-4B-Instruct-c_abliterated-v2.Q8_0.gguf [~4.2GB]
- Qwen3-VL-4B-Instruct-c_abliterated-v2.f16.gguf [~8GB]
- Qwen3-VL-8B-Instruct-c_abliterated-v3.Q4_K_M.gguf [~5.3GB]
- Qwen3-VL-8B-Instruct-c_abliterated-v3.Q5_K_M.gguf [~6.5GB]
- Qwen3-VL-8B-Instruct-c_abliterated-v3.Q6_K.gguf [~7.5GB]
- Qwen3-VL-8B-Instruct-c_abliterated-v3.Q8_0.gguf [~9GB]
- Qwen3-VL-8B-Instruct-c_abliterated-v3.f16.gguf [~16GB]
- Qwen3.5-27B-Q4_K_M.gguf [~15GB]
- Qwen3.5-27B-Q5_K_M.gguf [~18GB]
- Qwen3.5-27B-Q6_K.gguf [~21GB]
- Qwen3.5-27B-Q8_0.gguf [~27GB]
- Qwen3.5-27B-Uncensored-HauhauCS-Aggressive-BF16.gguf [~54GB]
- Qwen3.5-27B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf [~15GB]
- Qwen3.5-27B-Uncensored-HauhauCS-Aggressive-Q6_K.gguf [~21GB]
- Qwen3.5-27B-Uncensored-HauhauCS-Aggressive-Q8_0.gguf [~27GB]
- Qwen3.5-4B-BF16.gguf [~8GB]
- Qwen3.5-4B-Q4_K_M.gguf [~2.4GB]
- Qwen3.5-4B-Q6_K.gguf [~3.2GB]
- Qwen3.5-4B-Q8_0.gguf [~4.2GB]
- Qwen3.5-4B-Uncensored-HauhauCS-Aggressive-BF16.gguf [~8GB]
- Qwen3.5-4B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf [~2.4GB]
- Qwen3.5-4B-Uncensored-HauhauCS-Aggressive-Q6_K.gguf [~3.2GB]
- Qwen3.5-4B-Uncensored-HauhauCS-Aggressive-Q8_0.gguf [~4.2GB]
- Qwen3.5-9B-BF16.gguf [~17GB]
- Qwen3.5-9B-Q4_K_M.gguf [~5.3GB]
- Qwen3.5-9B-Q6_K.gguf [~7.5GB]
- Qwen3.5-9B-Q8_0.gguf [~9GB]
- Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-BF16.gguf [~17GB]
- Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf [~5.3GB]
- Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-Q6_K.gguf [~7.5GB]
- Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-Q8_0.gguf [~9GB]
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-IQ2_M.gguf
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-IQ3_M.gguf
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-IQ4_NL.gguf
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-IQ4_XS.gguf
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q2_K_P.gguf [~11GB]
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q3_K_P.gguf
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf [~20GB]
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_P.gguf
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q5_K_P.gguf
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q6_K_P.gguf [~31GB]
- Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q8_K_P.gguf
- gemma-4-12b-it-BF16.gguf [~24GB]
- gemma-4-12b-it-Q4_K_M.gguf [~7.5GB]
- gemma-4-12b-it-Q4_K_S.gguf [~7.5GB]
- gemma-4-12b-it-Q5_K_M.gguf [~9GB]
- gemma-4-12b-it-Q5_K_S.gguf [~9GB]
- gemma-4-12b-it-Q6_K.gguf [~11GB]
- gemma-4-12b-it-Q8_0.gguf [~13GB]
- gemma-4-12b-it-UD-Q4_K_XL.gguf
- gemma-4-26B-A4B-it-BF16.gguf
- gemma-4-26B-A4B-it-Q4_K_M.gguf [~15GB]
- gemma-4-26B-A4B-it-Q6_K.gguf
- gemma-4-26B-A4B-it-Q8_0.gguf [~24GB]
- gemma-4-31B-it-BF16.gguf
- gemma-4-31B-it-Q4_K_M.gguf [~20GB]
- gemma-4-31B-it-Q6_K.gguf
- gemma-4-31B-it-Q8_0.gguf [~32GB]
- gemma-4-E4B-it-BF16.gguf
- gemma-4-E4B-it-Q4_K_M.gguf [~5.4GB]
- gemma-4-E4B-it-Q6_K.gguf
- gemma-4-E4B-it-Q8_0.gguf [~8GB]
- google_gemma-4-E2B-it-Q4_K_S.gguf [~3.2GB]
- google_gemma-4-E2B-it-Q4_K_S.gguf [~3.2GB] (Gemma-4-E2B-Uncensored-GGUF [Q4:3.2GB|Q8:4.7GB|BF16:8.7GB|VRAM:~5GB])
- google_gemma-4-E2B-it-Q8_0.gguf [~4.7GB]
- google_gemma-4-E2B-it-Q8_0.gguf [~4.7GB] (Gemma-4-E2B-Uncensored-GGUF [Q4:3.2GB|Q8:4.7GB|BF16:8.7GB|VRAM:~5GB])
- google_gemma-4-E2B-it-bf16.gguf [~8.7GB]
- google_gemma-4-E2B-it-bf16.gguf [~8.7GB] (Gemma-4-E2B-Uncensored-GGUF [Q4:3.2GB|Q8:4.7GB|BF16:8.7GB|VRAM:~5GB])
- google_gemma-4-E4B-it-Q4_K_M.gguf [~5.4GB]
- google_gemma-4-E4B-it-Q5_K_M.gguf
- google_gemma-4-E4B-it-Q6_K.gguf
- google_gemma-4-E4B-it-Q8_0.gguf [~8GB]
- google_gemma-4-E4B-it-bf16.gguf
prompt_text STRING
preset_system_prompt
- ✍️ Custom Only (no preset)
- 📖 LTX 2.3 NSFW T2V Scene
- 📖 Wan 2.2 NSFW T2V Scene (20s)
- 🍿 Wan 2.2 NSFW T2V Timeline (3)
- 🍿 Wan 2.2 NSFW T2V Timeline (5s)
- 🎬 Wan 2.2 NSFW T2V Timeline (20s)
- 🎥 Wan 2.2 NSFW T2V Scene (3s)
- 🎥 Wan 2.2 NSFW T2V Scene (5s)
- 📝 Enhance
- 📝 Refine
- 📝 Creative Rewrite
- 📝 Detailed Visual
- 📝 Artistic Style
- 📝 Technical Specs
custom_system_prompt STRING
max_tokens INT
temperature FLOAT
top_p FLOAT
repetition_penalty FLOAT
english_output BOOLEAN
device
- auto
- cuda
- cpu
- mps
keep_model_loaded BOOLEAN
seed INT
keep_last_prompt BOOLEAN
stream_tokens_to_terminal BOOLEAN
enable_thinking BOOLEAN
auto_finalization_retry BOOLEAN
hf_token STRING
Outputs
STRING
STRING
Extension: ComfyUI-ThinkingLLM
A multimodal ComfyUI AI node with Qwen3.5, Qwen3-VL, Qwen2.5-VL, Qwen3, and Gemma 4 integrations. Features live thinking in the terminal to see what the LLM is doing in real time.
Authored by goodguy1963
Looking for a different node?
Run ComfyUI workflows without the setup
No installs, no CUDA version roulette, no GPU sitting idle on your bill. Bring a workflow and run it in the browser.