ComfyUI Node
Gemini视觉丨API
A ComfyUI node in QING/API with 11 inputs and 3 outputs.
Gemini视觉丨API
- image
- analysis_result
- conversation_info
- total_tokens
◄text_input请描述这张图片的内容。►
◄platformGoogle AI Studio►
◄modelgemini-2.5-flash-lite►
◄max_tokens4096►
◄history6►
◄temperature0.4►
◄top_p0.95►
◄image_qualityauto►
◄reasoning_effortnone►
◄clear_historyfalse►
CategoryQING/API
Inputs (11)
| Name | Type | Default | Description |
|---|---|---|---|
| image | IMAGE | 输入要分析的图像 | |
| text_input | STRING | 请描述这张图片的内容。 | 输入要发送给Gemini视觉模型的文本问题,Gemini擅长图像理解、多模态推理、代码生成和复杂视觉分析 |
| platform | COMBO | Google AI Studio | 选择API服务提供商 |
| model | COMBO | gemini-2.5-flash-lite | 选择要使用的Gemini视觉模型 📋 Google AI Studio模型特点: 🔸 gemini-2.5-pro:最新专业版,最强性能和思考能力 🔸 gemini-2.5-flash-preview-09-2025:2025年9月预览版Flash模型,最新特性 🔸 gemini-2.5-flash-lite-preview-09-2025:2025年9月预览版轻量模型,快速响应 🔸 gemini-2.5-flash:最新Flash模型,速度和质量平衡 🔸 gemini-2.5-flash-lite:轻量版2.5模型,快速响应 (默认推荐) 🔸 gemini-2.0-flash:新一代Flash模型,性能提升 💡 Gemini在多模态理解、代码识别、图表分析、创意生成方面表现优异 💭 2.5系列支持深度思考功能,可设置推理努力级别 📖 参考文档:https://ai.google.dev/gemini-api/docs/openai |
| max_tokens | INT | 40961–32768 | 模型生成文本时最多能使用的token数量 |
| history | INT | 61–25 | 保持的历史对话轮数 |
| temperatureopt | FLOAT | 0.40–2 | 控制生成文本的随机性 |
| top_popt | FLOAT | 0.950–1 | 控制生成文本的多样性 |
| image_qualityopt | COMBO | auto | 图像处理质量:auto(自动选择), low(低质量,速度快), high(高质量,精度高) |
| reasoning_effortopt | COMBO | none | 推理深度:none(关闭), low(轻度思考), medium(中度思考), high(深度思考) - Gemini 2.5系列特有功能 |
| clear_historyopt | BOOLEAN | false | 是否清除历史对话记录 |
Outputs (3)
| Name | Type | Description |
|---|---|---|
| analysis_result | STRING | — |
| conversation_info | STRING | — |
| total_tokens | INT | — |