Nodes/ComfyUI-QING/Gemini视觉丨API
ComfyUI Node

Gemini视觉丨API

A ComfyUI node in QING/API with 11 inputs and 3 outputs.

By sheengoa·Created 12 months ago·Updated 3 months ago· 16
Gemini视觉丨API
  • image
  • analysis_result
  • conversation_info
  • total_tokens
text_input请描述这张图片的内容。
platformGoogle AI Studio
modelgemini-2.5-flash-lite
max_tokens4096
history6
temperature0.4
top_p0.95
image_qualityauto
reasoning_effortnone
clear_historyfalse
CategoryQING/API

Inputs (11)

NameTypeDefaultDescription
imageIMAGE输入要分析的图像
text_inputSTRING请描述这张图片的内容。输入要发送给Gemini视觉模型的文本问题,Gemini擅长图像理解、多模态推理、代码生成和复杂视觉分析
platformCOMBOGoogle AI Studio选择API服务提供商
modelCOMBOgemini-2.5-flash-lite选择要使用的Gemini视觉模型 📋 Google AI Studio模型特点: 🔸 gemini-2.5-pro:最新专业版,最强性能和思考能力 🔸 gemini-2.5-flash-preview-09-2025:2025年9月预览版Flash模型,最新特性 🔸 gemini-2.5-flash-lite-preview-09-2025:2025年9月预览版轻量模型,快速响应 🔸 gemini-2.5-flash:最新Flash模型,速度和质量平衡 🔸 gemini-2.5-flash-lite:轻量版2.5模型,快速响应 (默认推荐) 🔸 gemini-2.0-flash:新一代Flash模型,性能提升 💡 Gemini在多模态理解、代码识别、图表分析、创意生成方面表现优异 💭 2.5系列支持深度思考功能,可设置推理努力级别 📖 参考文档:https://ai.google.dev/gemini-api/docs/openai
max_tokensINT40961–32768模型生成文本时最多能使用的token数量
historyINT61–25保持的历史对话轮数
temperatureoptFLOAT0.40–2控制生成文本的随机性
top_poptFLOAT0.950–1控制生成文本的多样性
image_qualityoptCOMBOauto图像处理质量:auto(自动选择), low(低质量,速度快), high(高质量,精度高)
reasoning_effortoptCOMBOnone推理深度:none(关闭), low(轻度思考), medium(中度思考), high(深度思考) - Gemini 2.5系列特有功能
clear_historyoptBOOLEANfalse是否清除历史对话记录

Outputs (3)

NameTypeDescription
analysis_resultSTRING
conversation_infoSTRING
total_tokensINT