Nodes/ComfyUI-QING/GLM视觉丨API
ComfyUI Node

GLM视觉丨API

A ComfyUI node in QING/API with 10 inputs and 3 outputs.

By sheengoa·Created 12 months ago·Updated 3 months ago· 16
GLM视觉丨API
  • image
  • generated_text
  • conversation_info
  • total_tokens
text_input请描述这张图片的内容。
platform智谱AI
modelGLM-4.1V-9B-Thinking
max_tokens4096
history8
temperature0.7
top_p0.90
image_qualityauto
clear_historyfalse
CategoryQING/API

Inputs (10)

NameTypeDefaultDescription
imageIMAGE输入要分析的图像
text_inputSTRING请描述这张图片的内容。输入要发送给GLM视觉模型的文本问题,GLM擅长图像理解、文档分析和视觉推理
platformCOMBO智谱AI选择API服务提供商
modelCOMBOGLM-4.1V-9B-Thinking选择要使用的GLM视觉模型 📋 智谱AI模型特点: 🔸 GLM-4.5V:最新视觉模型,全面提升的图像理解能力 🔸 GLM-4.1V-Thinking-FlashX:思维链推理版本,擅长复杂视觉分析 🔸 GLM-4V-Flash:快速响应版本,适合实时应用 🔸 GLM-4V:标准视觉版本,平衡性能和效果 🔸 GLM-4V-Plus:增强版本,高精度图像理解 📋 硅基流动模型特点: 🔸 GLM-4.5V:高性能视觉模型,性价比优秀 🔸 GLM-4.1V-9B-Thinking:9B参数思维链模型,高效推理 💡 GLM视觉模型在文档理解、图表分析、场景识别方面表现优异
max_tokensINT40961–32768模型生成文本时最多能使用的token数量
historyINT81–25保持的历史对话轮数
temperatureoptFLOAT0.70–2控制生成文本的随机性
top_poptFLOAT0.900–1控制生成文本的多样性
image_qualityoptCOMBOauto图像处理质量:auto(自动选择), low(低质量,速度快), high(高质量,精度高)
clear_historyoptBOOLEANfalse是否清除历史对话记录

Outputs (3)

NameTypeDescription
generated_textSTRING
conversation_infoSTRING
total_tokensINT