ComfyUI_LLM_Banana
A ComfyUI extension with 15 custom nodes.
Nodes (15)
Turn two frames into one smooth video-transition prompt
Point it at an image, get a model-ready prompt back
A translation node that works even with no API key
Free image-to-prompt expansion via Zhipu's GLM-4V-Flash
The one node in this pack that's actually local (and has a broken path)
Structured prompt templates for Gemini image models, mirror-friendly
Stack 30 images into one numbered grid so Gemini can find them
Nano Banana inside your graph
Same Gemini image editing, minus the Google billing account
Text-to-image via Nano Banana, through the mirror of your choice
Multi-image editing on the official API, with consistency control
Consistency without the Google key
The cleanest Nano Banana door
Feed it images, video, or audio and get Gemini's read on it
One node to rule all the Nano Banana mirrors
ComfyUI LLM Banana - 多模态AI助手节点集合
本仓库是 ComfyUI 的多模态 AI 助手节点集合,支持 Gemini 等多个供应商与镜像站的调用,并提供丰富的提示词模板与多模态分析能力。
新增功能速览(2025-11)
- Banana2-提示词模板节点:新增
base_url、version、auth_mode三个参数,并实现通用 API 调用与优先级回退逻辑(用户输入优先 → 供应商配置 → 全局配置 → 默认)。 - Gemini-Multimodal 节点同步:同样新增上述三参数,端点构建与认证策略与 Banana2 节点保持一致,体验统一。
以上更新与
NanoBanana-GeneralAPI的设计保持一致:支持自动/强制认证模式、灵活版本选择、以及自定义/镜像端点覆盖。
Banana2-提示词模板:通用 API 调用说明
在 Banana2 节点中,api_key 与 max_output_tokens 之间新增了以下参数:
base_url:自定义或镜像站的基础地址;当选择custom供应商时必须填写。version:接口版本,支持Auto、v1、v1alpha、v1beta。auth_mode:认证模式,支持auto、google_xgoog、bearer。
参数优先级与回退
- API Key:用户输入优先 → 供应商配置(
Gemini_config.json) → 全局配置 → 错误提示(缺失)。 - Base URL:用户输入优先 → 供应商配置 → 全局配置 → 供应商默认值。
- 选择
api_provider=custom时必须同时输入api_key与base_url,否则直接报错以避免不确定性。
版本选择策略(version=Auto)
- Google 官方域或
generativelanguage.googleapis.com:- 当
media_resolution=Auto使用v1beta; - 非
Auto时使用v1alpha(部分多模态特性在 alpha/beta 上线节奏不同)。
- 当
- 非 Google 域:默认使用
v1(绝大多数代理/镜像与 OpenAI 风格遵循/v1)。
认证模式说明
auto:若base_url包含generativelanguage.googleapis.com,使用x-goog-api-key;否则使用Authorization: Bearer <key>。google_xgoog:强制使用x-goog-api-key(用于兼容某些代理明确要求此头部)。bearer:强制使用Authorization: Bearer <key>。
端点构建规则
- 若用户提供的
base_url已是完整端点(包含/models/<model>:generateContent),则直接使用原值,不再拼接。 - 否则按照通用格式拼接:
base_url/<version>/models/<model>:generateContent- 若
base_url已以/v1、/v1alpha或/v1beta结尾,则拼接成:<base_url>/models/<model>:generateContent
示例(快速验证)
- 官方 Google:
api_provider=google,只填api_key,base_url留空,version=Auto,auth_mode=auto。- 预期行为:请求 URL 使用
v1beta;请求头包含x-goog-api-key。
- 自定义/代理服务:
api_provider=custom,填写base_url=https://your.proxy/v1,auth_mode=bearer,填写api_key。- 预期行为:请求 URL 为
https://your.proxy/v1/models/<model>:generateContent;请求头为Authorization: Bearer <key>。
配置文件(Gemini_config.json)示例
{
"api_key": "GLOBAL_KEY_OPTIONAL",
"base_url": "https://generativelanguage.googleapis.com",
"api_providers": {
"google": { "api_key": "YOUR_GOOGLE_KEY" },
"comet": { "base_url": "https://api.cometapi.com" },
"comfly": { "base_url": "https://ai.comfly.chat/v1" },
"aabao": { "base_url": "https://api.aabao.top/v1" }
}
}
Gemini-Multimodal:参数与行为同步
- 新增
base_url、version、auth_mode三参数,位置在api_key之后。 - 与 Banana2 节点一致的端点构建与认证策略:
- 端点:遵循完整端点直通与通用拼接规则;
- 认证:
auto/google_xgoog/bearer; - 版本:
Auto下针对 Google/非 Google 的分支选择。
若页面未显示新参数,请在 ComfyUI 左侧点击 “Reload Custom Nodes” 或重启 ComfyUI 以加载最新代码。
日志与验证
- 在工作流运行时,关注日志中的
Request URL与Request Headers,- 确认是否触发了期望的版本(如
v1beta)与认证头(x-goog-api-key或Authorization: Bearer)。
- 确认是否触发了期望的版本(如
- 异常场景:
custom供应商且缺失api_key或base_url会直接报错;- 当既无用户输入也无配置提供
api_key时会报错提示缺失凭据。
已知供应商默认 Base URL(参考)
google:https://generativelanguage.googleapis.comcomet:https://api.cometapi.comcomfly:https://ai.comfly.chat/v1aabao:https://api.aabao.top/v1
注意:部分镜像/代理可能采用 OpenAI 风格的
/v1路径;如存在兼容性问题,可通过base_url与auth_mode的强制设置进行修正。
快速上手与示例工作流
- 快速上手文档:
docs/banana2_quick_start.md - 提示词模板指南:
docs/banana2_prompt_template_guide.md - 示例工作流参考:
examples/与根目录诸多*.json文件(包括镜像 API 调用示例)。
NanoBanana-GeneralAPI:节点与功能
- 作用:提供统一的通用 REST API 调用能力,支持官方域与各类镜像/代理,并与 Banana2/Gemini-Multimodal 的端点与认证逻辑保持一致。
- 特点:
- 支持镜像站下拉选择(
mirror_site),从Gemini_Banana_config.json的mirror_sites动态加载选项; - 参数优先级回退:用户输入 → 镜像站配置 → 全局配置 → 默认供应商地址;
- 认证模式与版本选择与上文一致,支持自动/强制模式与
Auto/v1/v1alpha/v1beta。
- 支持镜像站下拉选择(
参数说明
mirror_site:镜像站选择;默认站点由配置文件定义。选择custom时需自填端点与凭据。api_key:API 密钥;custom模式必须填写。base_url:基础地址;custom模式必须填写。可填完整端点(含/models/<model>:generateContent)以直通。version:接口版本;支持Auto、v1、v1alpha、v1beta。auth_mode:认证模式;支持auto、google_xgoog、bearer。model/custom_model:当镜像站提供模型下拉时选择model;在custom模式下可使用custom_model手动填入。
端点与认证规则
- 端点拼接:
- 完整端点直通(用户已提供
/models/<model>:generateContent); - 否则
base_url/<version>/models/<model>:generateContent;当base_url已以/v1|/v1alpha|/v1beta结尾时拼接为.../models/<model>:generateContent。
- 完整端点直通(用户已提供
- 认证模式:
auto:Google 域走x-goog-api-key,其他走Authorization: Bearer;google_xgoog:强制x-goog-api-key;bearer:强制Authorization: Bearer。
优先级与回退策略
API Key:用户输入 → 镜像站配置 → 全局配置 → 错误提示(缺失)。Base URL:用户输入 → 镜像站配置 → 全局配置 → 供应商默认值(例如 Google 为https://generativelanguage.googleapis.com)。custom镜像站:必须同时输入api_key与base_url。
配置示例(Gemini_Banana_config.json)
{
"api_key": "GLOBAL_KEY_OPTIONAL",
"base_url": "https://generativelanguage.googleapis.com",
"mirror_sites": {
"nano-banana官方": {"url": "https://generativelanguage.googleapis.com", "api_key": "YOUR_GOOGLE_KEY"},
"comfly": {"url": "https://ai.comfly.chat/v1", "api_key": "YOUR_COMFLY_KEY"},
"aabao": {"url": "https://api.aabao.top/v1"},
"custom": {"url": "", "api_key": ""}
}
}
快速验证
- 选择
mirror_site=nano-banana官方,不填base_url只填api_key,version=Auto、auth_mode=auto:- 预期 URL 选择
v1beta或v1alpha(取决于任务多模态需求),头部为x-goog-api-key。
- 预期 URL 选择
- 选择
mirror_site=comfly(或其它代理),留空base_url:- 使用镜像站配置中的
url与可用的api_key;非 Google 域默认版本为v1,头部为Authorization: Bearer。
- 使用镜像站配置中的
- 选择
mirror_site=custom,填写自定义base_url与api_key,auth_mode=bearer:- 端点为
base_url/<version>/models/<model>:generateContent(或完整端点直通);头部为Authorization: Bearer <key>。
- 端点为
变更日志(节选)
- 新增:Banana2-提示词模板与 Gemini-Multimodal 节点的
base_url、version、auth_mode参数。 - 统一:端点构建与认证策略,支持自动/强制模式与自定义端点直通。
- 逻辑:优先级回退(用户输入 → 供应商配置 → 全局 → 默认),与
NanoBanana-GeneralAPI保持一致。
一个功能强大的ComfyUI自定义节点集合,集成了多种大语言模型和AI服务,支持文本生成、图像生成、图像分析、翻译等多种AI功能。
🆕 专属更新:Nano Banana 2 与重大功能
- 完整更新说明与迁移指南请见:
README_NANO_BANANA_2_UPDATE.md - 重点变化:NB2 使用 Gemini 原生 generateContent、imageConfig 支持 1K/2K/4K、镜像端点自动选择与纠偏、迭代优化全链路、多图编辑稳健性与智能AI放大
🌟 主要特性
- 🍌 Banana系列节点: 专业的图像编辑和多图处理能力,支持批量操作
- 🎨 强大的图像编辑: 智能图像到图像编辑、多图像同时编辑、内容感知处理
- 🔄 双API架构: 官方API节点 + 镜像API节点,确保服务稳定性和可用性
- 🚀 多模型支持: Gemini、GLM、OpenRouter、Nano-Banana等多种AI模型
- 📸 专业图像生成: 支持文本到图像生成,多种尺寸和质量选项
- 🔍 智能图像分析: 图像描述、内容分析、视觉问答、场景理解
- 🌐 多语言翻译: 支持50+语言的专业翻译服务
- ⚡ 高性能处理: AI超分辨率、智能裁剪、批量质量优化
- 🛠️ 灵活配置: 支持多种API端点、代理设置和自定义参数
- 🛡️ 安全设置: 5个安全级别预设,完全符合Google Gemini官方标准 ⭐ NEW
- 🎯 系统指令: 7个专业预设模板 + 自定义指令支持 ⭐ NEW
- 📐 标准化API: Response Modalities格式统一,完全兼容官方API ⭐ NEW
- 🧹 优化体验: 启动输出精简68%,加载更快更清晰 ⭐ NEW
📸 功能展示
视频反推及扩写

Flux 提示词生成
反推

扩写

📦 安装指南
方法一:Git克隆(推荐)
cd ComfyUI/custom_nodes
git clone https://github.com/your-repo/ComfyUI_LLM_Banana.git
cd ComfyUI_LLM_Banana
pip install -r requirements.txt
方法二:手动下载
- 下载项目压缩包并解压到
ComfyUI/custom_nodes/ComfyUI_LLM_Banana - 安装依赖:
cd ComfyUI/custom_nodes/ComfyUI_LLM_Banana
pip install -r requirements.txt
依赖要求
- Python 3.8+
- PyTorch
- Pillow
- requests
- numpy
- google-generativeai (可选,用于官方Gemini API)
🔧 配置设置
API密钥配置
在使用前,您需要配置相应的API密钥:
- Gemini API: 获取Google AI Studio API密钥
- GLM API: 获取智谱AI API密钥 - bigmodel.cn
- OpenRouter API: 获取OpenRouter API密钥
- Nano-Banana: 获取相应服务的API密钥
代理设置
如果需要使用代理,可以在节点中配置:
- HTTP代理:
http://proxy:port - SOCKS代理:
socks5://proxy:port
📋 节点说明
🍌 Banana系列核心节点
ComfyUI LLM Banana的核心优势在于其强大的Banana系列节点,提供了业界领先的图像编辑和多图处理能力。
🎯 双API架构设计
官方API节点 (3个核心节点):
- Gemini Banana - Google官方API调用
- GLM Banana - 智谱AI官方API调用
- OpenRouter Banana - OpenRouter官方API调用
镜像API节点 (3个镜像节点):
- Gemini Banana Mirror - 镜像站点调用,突破网络限制
- Comfly Nano Banana - Comfly镜像服务,支持Nano-Banana模型
- T8 Mirror Banana - T8镜像站点,提供稳定的备用服务
🤖 官方API节点详解
Gemini Banana (Google官方API)
-
功能: 使用Google官方Gemini API进行多模态AI处理
-
核心特性:
- ✅ 图像到图像编辑: 智能修改现有图像内容
- ✅ 多图像批量处理: 同时处理多张图像
- ✅ 视觉理解: 深度图像内容分析
- ✅ 文本生成: 高质量文本创作
- ✅ 安全设置: 5个安全级别预设,精确控制内容过滤 ⭐ NEW
- ✅ 系统指令: 7个专业模板 + 自定义指令支持 ⭐ NEW
-
输入参数:
prompt: 文本提示词或编辑指令image: 输入图像(支持多图)api_key: Google API密钥model: 模型选择 (gemini-1.5-pro, gemini-1.5-flash等)temperature→ 创造性控制 (0.0-2.0)top_p→ 概率截断 (0.0-1.0,默认 0.9)top_k→ 词汇截断 (1-1000,常用 40)max_output_tokens→ 最大输出长度safety_level: 安全级别 (default, strict, moderate, permissive, off) ⭐ NEWsystem_instruction_preset: 系统指令预设 (image_generation, creative_artist等) ⭐ NEWcustom_system_instruction: 自定义系统指令 ⭐ NEW
参数显示顺序:temperature → top_p → top_k → max_output_tokens
-
输出: 编辑后的图像 + 描述文本
-
特性:
- 🔥 强大的图像编辑能力: 支持局部修改、风格转换、内容替换
- 🔥 多图像协同编辑: 可同时编辑多张相关图像
- 🔥 智能内容理解: 准确识别图像内容并进行精确编辑
- 🔥 安全可控: 灵活的安全设置,适应不同应用场景 ⭐ NEW
- 🔥 行为定制: 系统指令让AI扮演特定角色,提升输出质量 ⭐ NEW
GLM Banana (智谱AI官方API)
- 功能: 使用智谱AI官方GLM模型,专门优化中文处理
- 核心特性:
- ✅ 中文图像理解: 专业的中文图像描述和分析
- ✅ 中文文本生成: 高质量中文内容创作
- ✅ 多模态处理: 图文结合的智能处理
- 输入参数:
prompt: 中文提示词image: 输入图像(可选)api_key: 智谱AI API密钥model: GLM模型版本 (GLM-4, GLM-4-Flash, GLM-4V等)temperature: 温度参数
- 输出: 中文文本内容或图像分析结果
- 特性:
- 🔥 中文优化: 专门针对中文语境优化
- 🔥 免费额度: GLM-4-Flash提供大量免费调用
- 🔥 多模态能力: GLM-4V支持图像理解
OpenRouter Banana (多模型聚合API)
- 功能: 通过OpenRouter平台访问多种顶级AI模型
- 核心特性:
- ✅ 模型选择丰富: Claude、GPT、Llama、Mistral等
- ✅ 统一接口: 一个API密钥访问多种模型
- ✅ 成本优化: 根据需求选择最适合的模型
- 输入参数:
prompt: 提示词model: 模型选择 (claude-3-opus, gpt-4, llama-3等)api_key: OpenRouter API密钥temperature: 创造性参数
- 输出: 生成的文本内容
- 特性:
- 🔥 模型多样性: 支持20+种主流AI模型
- 🔥 灵活计费: 按使用量付费,成本可控
- 🔥 高可用性: 多个模型提供商确保服务稳定
🌐 镜像API节点详解
Gemini Banana Mirror (镜像站点)
- 功能: 通过镜像站点调用Gemini API,突破网络访问限制
- 核心特性:
- ✅ 网络优化: 解决官方API访问困难的问题
- ✅ 完整功能: 保持与官方API相同的功能特性
- ✅ 图像编辑: 支持图像到图像的智能编辑
- ✅ 多图处理: 批量处理多张图像
- 输入参数:
prompt: 编辑指令或描述image: 输入图像(支持多图)api_key: 镜像站点API密钥base_url: 镜像站点地址model: Gemini模型选择
- 输出: 编辑后的图像 + 处理说明
- 特性:
- 🔥 突破限制: 解决网络访问问题
- 🔥 稳定服务: 多个镜像站点备选
- 🔥 完整兼容: 与官方API功能完全一致
Comfly Nano Banana (Comfly镜像服务)
- 功能: 专门的图像生成和编辑服务,支持Nano-Banana模型
- 核心特性:
- ✅ 专业图像生成: 高质量文本到图像生成
- ✅ 图像编辑: 基于现有图像进行智能修改
- ✅ 多尺寸支持: 支持各种图像尺寸和比例
- ✅ 种子控制: 可重现的图像生成结果
- 输入参数:
prompt: 图像描述或编辑指令image: 输入图像(编辑模式)api_url: Comfly服务地址api_key: API密钥size: 图像尺寸 (512x512, 1024x1024等)seed: 随机种子值
- 输出: 生成或编辑后的图像
- 特性:
- 🔥 快速生成: 优化的图像生成速度
- 🔥 高质量输出: 专业级图像质量
- 🔥 灵活控制: 丰富的参数调节选项
T8 Mirror Banana (T8镜像站点)
- 功能: T8镜像站点服务,提供稳定的AI图像处理能力
- 核心特性:
- ✅ 多模型支持: 支持多种图像生成模型
- ✅ 稳定服务: 高可用性的镜像服务
- ✅ 批量处理: 支持多图像批量操作
- ✅ 格式兼容: 支持多种图像格式输入输出
- 输入参数:
prompt: 处理指令image: 输入图像api_url: T8镜像地址model: 模型选择quality: 质量设置
- 输出: 处理后的图像
- 特性:
- 🔥 服务稳定: 专业的镜像服务提供商
- 🔥 多模型: 集成多种AI图像处理模型
- 🔥 高性能: 优化的处理速度和质量
🎨 强大的图像编辑和生成功能
🔥 图像到图像编辑 (Image-to-Image Editing)
Banana系列节点的核心优势
支持的编辑类型:
- 局部内容修改: 替换图像中的特定对象或区域
- 风格转换: 改变图像的艺术风格或色调
- 内容增强: 提升图像质量、细节和清晰度
- 场景重构: 修改背景、环境或整体构图
- 多图协同: 同时编辑多张相关图像,保持一致性
编辑工作流程:
- 输入原图: 加载需要编辑的图像
- 编辑指令: 提供详细的修改描述
- 智能处理: AI理解图像内容和编辑需求
- 精确修改: 保持原图结构,精确执行编辑
- 质量优化: 自动优化编辑后的图像质量
🔥 多图像批量编辑 (Multi-Image Editing)
业界领先的批量处理能力
批量编辑特性:
- 同时处理: 一次性编辑多张图像
- 一致性保持: 确保多图编辑结果风格统一
- 关联处理: 理解图像间的关联关系
- 批量优化: 统一的质量和风格标准
- 效率提升: 大幅提高工作效率
适用场景:
- 📸 摄影后期: 批量调色、风格统一
- 🎨 设计工作: 系列图像的风格调整
- 🛍️ 电商产品: 产品图片的批量优化
- 📱 社交媒体: 内容创作的批量处理
Gemini Banana Image Generator (专业图像生成)
- 功能: 高级文本到图像生成 + 图像编辑
- 核心特性:
- ✅ 文本生图: 根据描述生成高质量图像
- ✅ 图像编辑: 基于现有图像进行智能修改
- ✅ 多图处理: 同时处理多张图像
- ✅ 专业控制: 丰富的摄影和艺术参数
- 输入参数:
prompt: 图像描述或编辑指令image: 输入图像(编辑模式,可多图)size: 图像尺寸 (512x512, 1024x1024, 1024x1792等)quality: 质量等级 (Basic, Professional, Premium, Masterpiece)style: 风格控制 (写实、艺术、卡通、电影等)detail_level: 细节等级控制camera_control: 专业相机参数lighting_control: 灯光设置template_selection: 预设模板选择
- 输出: 生成或编辑后的高质量图像
- 特性:
- 🔥 专业级质量: 支持4K+超高清输出
- 🔥 智能编辑: 理解图像内容,精确修改
- 🔥 批量处理: 高效的多图像处理能力
Nano-Banana Image Generator (快速生成)
- 功能: 快速图像生成和编辑服务
- 核心特性:
- ✅ 高速生成: 优化的生成速度
- ✅ 种子控制: 可重现的生成结果
- ✅ 多尺寸: 灵活的尺寸选择
- ✅ 镜像支持: 多个服务节点备选
- 输入参数:
prompt: 生成或编辑指令image: 输入图像(编辑模式)size: 尺寸选择seed: 随机种子值api_url: 服务端点选择
- 输出: 快速生成的高质量图像
- 特性:
- 🔥 极速处理: 秒级图像生成
- 🔥 稳定输出: 种子控制确保结果可重现
- 🔥 多节点: 负载均衡,服务稳定
🔍 图像分析节点
Gemini Vision Analyzer
- 功能: 图像内容分析和描述
- 输入:
image: 输入图像prompt: 分析提示词api_key: Gemini API密钥model: 视觉模型选择
- 输出: 图像描述文本
- 特性:
- 智能场景识别
- 详细内容描述
- 支持多语言输出
JoyCaption (图像描述)
- 功能: 专业图像标注和描述
- 输入:
image: 输入图像caption_type: 描述类型caption_length: 描述长度
- 输出: 结构化图像描述
- 特性: 适合训练数据标注,支持多种描述风格
🌐 翻译节点
Gemini Banana Translation
- 功能: 多语言文本翻译
- 输入:
text: 源文本source_language: 源语言target_language: 目标语言api_key: API密钥
- 输出: 翻译后的文本
- 支持语言: 中文、英文、日文、韩文、法文、德文等50+语言
- 特性:
- 上下文感知翻译
- 专业术语处理
- 批量翻译支持
🎯 图像处理节点
AI Image Upscaler
- 功能: AI超分辨率图像放大
- 输入:
image: 低分辨率图像scale_factor: 放大倍数model_type: 放大算法选择
- 输出: 高分辨率图像
- 特性:
- 多种放大算法 (Real-ESRGAN, ESRGAN, Waifu2x)
- 细节保持优化
- 批量处理支持
Smart Image Resizer
- 功能: 智能图像尺寸调整
- 输入:
image: 原图像target_size: 目标尺寸fill_strategy: 填充策略fill_color: 填充颜色
- 输出: 调整后的图像
- 特性:
- 智能裁剪
- 内容感知填充
- 宽高比保持
🔧 工具节点
Universal Subject Detection
- 功能: 通用主体检测
- 输入: 图像
- 输出: 主体检测结果
- 特性: 自动识别图像中的主要对象
Adaptive Enhancement
- 功能: 自适应图像增强
- 输入: 图像、增强参数
- 输出: 增强后的图像
- 特性: 智能调整对比度、亮度、饱和度
🚀 使用示例
🆕 安全设置与系统指令使用 (v2.1新功能)
使用安全设置控制内容:
- 添加 "Gemini Banana" 节点
- 设置
safety_level参数:strict- 严格模式,适合儿童内容moderate- 中等模式,适合一般应用permissive- 宽松模式,适合创意工作off- 关闭过滤,适合专业用途
- 执行工作流,享受精确的内容控制
使用系统指令提升质量:
- 添加 "Gemini Banana Image Generator" 节点
- 选择
system_instruction_preset:image_generation- 图像生成助手creative_artist- 创意艺术家professional_photographer- 专业摄影师technical_expert- 技术专家
- 或者使用
custom_system_instruction输入自定义指令 - 执行工作流,获得更专业的输出
组合使用示例 - 儿童教育应用:
safety_level: strict
system_instruction_preset: friendly_helper
prompt: "创建一个友好的卡通角色教孩子们学习数字"
组合使用示例 - 专业摄影:
safety_level: moderate
system_instruction_preset: professional_photographer
custom_system_instruction: "你是一位专业的人像摄影师,擅长捕捉自然光线和情感表达"
prompt: "拍摄一张温馨的家庭肖像照"
🔥 图像到图像编辑工作流 (核心功能)
单图编辑示例:
- 使用 "Load Image" 节点加载原始图像
- 添加 "Gemini Banana" 或 "Gemini Banana Mirror" 节点
- 连接图像输入
- 输入编辑指令:"将这张照片的背景改为海滩日落场景,保持人物不变"
- 设置模型为 "gemini-1.5-pro"
- 配置API密钥或镜像地址
- 连接到图像预览节点
- 执行工作流,获得编辑后的图像
多图批量编辑示例:
- 使用多个 "Load Image" 节点加载图像序列
- 添加 "Gemini Banana" 节点
- 连接所有图像输入
- 输入批量编辑指令:"统一将这些产品图片的背景改为纯白色,保持产品细节"
- 设置批量处理参数
- 执行工作流,同时获得多张编辑后的图像
🎨 专业图像生成工作流
高质量图像生成:
- 添加 "Gemini Banana Image Generator" 节点
- 输入详细提示词:"一只优雅的白猫坐在古典书房里,温暖的壁炉光线,油画风格,专业摄影构图"
- 设置参数:
- 尺寸: "1024x1024"
- 质量: "Masterpiece Level"
- 风格: "Classical Oil Painting"
- 细节等级: "Premium Quality"
- 相机控制: "Professional Portrait"
- 灯光控制: "Soft Glow"
- 连接到图像预览节点
- 执行工作流
快速图像生成 (Nano-Banana):
- 添加 "Comfly Nano Banana" 节点
- 输入提示词:"现代简约风格的客厅设计"
- 设置尺寸为 "1024x1024"
- 设置种子值 (可选,用于重现结果)
- 选择合适的API端点
- 执行工作流,快速获得结果
🌐 镜像API使用工作流
突破网络限制:
- 添加 "Gemini Banana Mirror" 节点
- 配置镜像站点地址
- 输入处理指令
- 设置代理参数 (如需要)
- 执行工作流,享受稳定的服务
🔍 智能图像分析工作流
- 使用 "Load Image" 节点加载图像
- 连接到 "Gemini Vision Analyzer" 节点
- 输入分析提示:"详细分析这张图片的构图、色彩、情感表达和艺术价值"
- 连接到文本输出节点
- 执行工作流,获得专业的图像分析
🌍 多语言翻译工作流
- 添加 "Gemini Banana Translation" 节点
- 输入要翻译的文本
- 设置源语言和目标语言
- 选择翻译质量等级
- 连接到文本输出节点
- 执行工作流
📈 批量处理优化工作流
大批量图像处理:
- 准备多张需要处理的图像
- 使用 "Gemini Banana" 节点的批量模式
- 设置统一的处理参数
- 配置输出格式和质量
- 执行批量处理,提高工作效率
⚙️ 高级配置
🆕 安全设置与系统指令配置 (v2.1)
安全设置预设:
{
"safety_presets": {
"default": "使用Google默认安全设置",
"strict": "严格模式 - 阻止大多数不安全内容",
"moderate": "中等模式 - 阻止中等及以上不安全内容",
"permissive": "宽松模式 - 仅阻止高度不安全内容",
"off": "关闭模式 - 不进行安全过滤"
}
}
系统指令预设模板:
{
"system_instruction_presets": {
"none": "无系统指令",
"image_generation": "专业图像生成助手",
"image_editing": "专业图像编辑助手",
"creative_artist": "创意艺术家",
"technical_expert": "技术专家",
"friendly_helper": "友好助手",
"professional_photographer": "专业摄影师"
}
}
自定义系统指令示例:
{
"custom_system_instruction": "你是一位专业的产品摄影师,擅长电商产品拍摄。请确保产品细节清晰,背景简洁,光线均匀。"
}
Banana节点专用配置
官方API节点配置:
{
"gemini_api_base": "https://generativelanguage.googleapis.com",
"glm_api_base": "https://open.bigmodel.cn/api/paas/v4/",
"openrouter_api_base": "https://openrouter.ai/api/v1",
"image_editing_settings": {
"max_batch_size": 5,
"quality_enhancement": true,
"smart_resize": true
},
"safety_settings": {
"default_level": "moderate",
"custom_categories": {
"HARM_CATEGORY_HARASSMENT": "BLOCK_MEDIUM_AND_ABOVE",
"HARM_CATEGORY_HATE_SPEECH": "BLOCK_MEDIUM_AND_ABOVE",
"HARM_CATEGORY_SEXUALLY_EXPLICIT": "BLOCK_MEDIUM_AND_ABOVE",
"HARM_CATEGORY_DANGEROUS_CONTENT": "BLOCK_MEDIUM_AND_ABOVE"
}
},
"system_instruction": {
"default_preset": "image_generation",
"allow_custom": true
}
}
镜像API节点配置:
{
"mirror_endpoints": {
"gemini_mirror": "https://your-gemini-mirror.com",
"comfly_endpoint": "https://api.comfly.ai",
"t8_mirror": "https://ai.t8star.cn"
},
"fallback_settings": {
"auto_fallback": true,
"retry_attempts": 3,
"timeout_seconds": 60
},
"proxy_settings": {
"http": "http://proxy:port",
"https": "https://proxy:port"
}
}
图像编辑优化配置:
{
"image_processing": {
"max_resolution": "2048x2048",
"compression_quality": 95,
"format_preference": "PNG",
"batch_processing": {
"enabled": true,
"max_concurrent": 3,
"memory_limit": "4GB"
}
}
}
环境变量配置
支持通过环境变量配置API密钥:
export GEMINI_API_KEY="your_gemini_api_key"
export ZHIPUAI_API_KEY="your_glm_api_key"
export OPENROUTER_API_KEY="your_openrouter_api_key"
Banana节点性能优化
图像编辑性能优化:
- 🚀 智能批量处理: 同时处理多达10张图像,效率提升10倍
- 🚀 内存优化: 智能内存管理,支持大尺寸图像编辑
- 🚀 并发处理: 多线程异步处理,充分利用系统资源
- 🚀 缓存机制: 智能结果缓存,相似请求秒级响应
API调用优化:
- 🌐 双重保障: 官方API + 镜像API,确保服务可用性
- 🌐 自动切换: 检测到官方API不可用时自动切换到镜像
- 🌐 负载均衡: 多个镜像节点分担负载,提高稳定性
- 🌐 智能重试: 失败自动重试,指数退避算法优化
质量与速度平衡:
- ⚡ 快速模式: Nano-Banana节点,秒级图像生成
- 🎨 质量模式: Gemini节点,专业级图像编辑
- 🔄 自适应: 根据任务复杂度自动选择最优处理方式
- 📊 实时监控: 处理进度实时反馈,透明化处理过程
🐛 故障排除
常见问题
1. API密钥错误
- 问题: "Invalid API key" 或 "Authentication failed"
- 解决: 检查API密钥是否正确配置,确认密钥有效且有足够额度
2. 网络连接问题
- 问题: "Connection timeout" 或 "Network error"
- 解决: 检查网络连接,配置正确的代理设置
3. 模型不可用
- 问题: "Model not found" 或 "Model not supported"
- 解决: 确认选择的模型在当前API中可用,检查模型名称拼写
4. 内存不足
- 问题: "Out of memory" 或系统卡顿
- 解决: 降低批量大小、减少图像分辨率、关闭不必要的应用
5. 图像生成失败
- 问题: 生成黑色或异常图像
- 解决: 检查提示词是否合适,尝试不同的模型或参数
调试模式
v2.1 优化说明:
- ✅ 启动输出已精简 68%,减少控制台噪音
- ✅ 移除了不存在模块的错误提示
- ✅ 保留了所有必要的错误日志
如需启用详细调试信息:
- 找到节点文件中的日志函数
_log_info(),_log_warning() - 将函数内的
pass改为相应的print语句 - 重启ComfyUI查看详细日志
调试输出控制:
# 在 gemini_banana.py 中
def _log_info(message):
# pass # 默认关闭
print(f"[INFO] {message}") # 启用调试
def _log_warning(message):
# pass # 默认关闭
print(f"[WARNING] {message}") # 启用调试
免费模型推荐
为了节省成本,推荐使用以下免费或低成本模型:
- GLM-4-Flash: 智谱AI的免费模型,适合文本生成
- GLM-4V-Flash: 支持图像理解的免费模型
- Gemini-1.5-Flash: Google的快速模型,有免费额度
📄 许可证
本项目采用 MIT 许可证 - 查看 LICENSE 文件了解详情。
🤝 贡献
欢迎提交问题报告和功能请求!如果您想贡献代码,请:
- Fork 本项目
- 创建功能分支 (
git checkout -b feature/AmazingFeature) - 提交更改 (
git commit -m 'Add some AmazingFeature') - 推送到分支 (
git push origin feature/AmazingFeature) - 创建 Pull Request
� Support the Project
☕ Buy Me a Coffee
如果您觉得 ComfyUI LLM Banana 对您有帮助,让您的 AI 图像生成项目更加轻松,请考虑支持开发!
💜 Your support helps:
- 🚀 Accelerate new feature development - 加速新功能开发
- 🧠 Enhance AI capabilities - 增强 AI 能力
- 🔧 Improve system stability - 提升系统稳定性
- 📚 Create better documentation - 创建更好的文档
- 🌍 Support the open source community - 支持开源社区
<table> <tr> <td align="center" width="50%">
💬 WeChat Contact
<img src="/image/微信图片_20250620124237.png" alt="WeChat QR Code" width="200px" />Scan to add WeChat 扫码添加微信
WeChat ID: Kenchen7168
</td> <td align="center" width="50%">☕ Support Development
<img src="/image/微信图片_20250620124237.png" alt="Buy Me a Coffee" width="200px" />Scan to buy me a coffee 扫码请我喝咖啡
☕ Every coffee counts! 每一杯咖啡都是支持!
</td> </tr> </table>🙏 Thank you for your support!
Your contributions, whether through code, feedback, or coffee, make ComfyUI LLM Banana better for everyone!
谢谢您的支持!无论是代码贡献、反馈建议还是请我喝咖啡,都让 ComfyUI LLM Banana 变得更好!
📞 Community & Support
如果您遇到问题或需要帮助:
- 💬 WeChat: Kenchen7168 (扫描上方二维码添加)
- 🐛 Issues: GitHub Issue
- 📖 Documentation: 查看项目文档和示例
- 🌟 Star: 如果觉得有用,请给项目一个星标!
🔄 更新日志
v2.1.0 (2025-10-12) - 质量与体验全面提升 🎉
🛡️ 安全设置与系统指令 (Safety Settings & System Instruction):
- ✅ 安全设置支持: 新增 5 个安全级别预设(default, strict, moderate, permissive, off)
- ✅ 系统指令功能: 7 个专业预设模板(图像生成助手、创意艺术家、专业摄影师等)
- ✅ 自定义指令: 支持用户自定义系统指令,优先级高于预设
- ✅ 完全兼容: 符合 Google Gemini 官方 API 标准
- ✅ 全节点覆盖: 所有 7 个 Gemini Banana 节点均已支持
📐 Response Modalities 标准化:
- ✅ 格式统一: 统一使用
["Text", "Image"]格式,符合官方标准 - ✅ 智能转换: 自动规范化不同格式的输入
- ✅ 向后兼容: 完全兼容旧版工作流
- ✅ 代码优化: 创建
normalize_response_modalities()辅助函数
🧹 启动体验优化:
- ✅ 输出精简: 启动输出减少 68%(从 22 行减少到 7 行)
- ✅ 移除冗余: 清理 19 个无用的调试输出
- ✅ 错误清理: 移除不存在模块的错误提示
- ✅ 代码精简: 删除 53 行无用代码
- ✅ 加载更快: 优化模块加载逻辑,启动更流畅
📚 文档完善:
- ✅ 详细指南: 新增安全设置和系统指令使用指南
- ✅ 快速参考: 创建快速参考文档,方便查阅
- ✅ 实现总结: 完整的技术实现文档
- ✅ 测试覆盖: 100% 测试通过,功能稳定可靠
🔧 技术改进:
- ✅ 代码质量: 移除重复代码,提升可维护性
- ✅ 性能优化: 优化 AI 模型检测逻辑
- ✅ 错误处理: 改进异常处理机制
- ✅ 模块清理: 移除已废弃的模块引用
v1.0.0 - Banana系列节点重大更新
🍌 核心功能突破:
- ✅ 图像到图像编辑: 业界领先的图像编辑能力
- ✅ 多图批量处理: 同时编辑多张图像,效率提升10倍
- ✅ 双API架构: 官方API + 镜像API,确保服务稳定性
- ✅ 6大核心节点: 3个官方API节点 + 3个镜像API节点
🚀 技术创新:
- ✅ 智能图像理解: 深度理解图像内容,精确执行编辑指令
- ✅ 内容感知编辑: 保持图像结构,智能修改指定区域
- ✅ 批量一致性: 多图编辑保持风格和质量一致性
- ✅ 专业级控制: 丰富的摄影和艺术参数控制
🌐 服务优化:
- ✅ 网络突破: 镜像节点解决网络访问限制
- ✅ 自动切换: 官方API不可用时自动切换镜像
- ✅ 负载均衡: 多节点分担负载,提高稳定性
- ✅ 性能优化: 内存管理、并发处理、智能缓存
🛠️ 用户体验:
- ✅ 简化操作: 一键式图像编辑,降低使用门槛
- ✅ 实时反馈: 处理进度实时显示
- ✅ 错误处理: 智能错误恢复和提示
- ✅ 文档完善: 详细的使用指南和示例
历史更新
- 6-28: 新增翻译节点,支持50+语言翻译
- 6-20: 集成FLUX提示词模板,优化提示词生成
- 持续优化: 性能提升、稳定性改进、功能扩展
🙏 致谢
感谢以下项目和开发者的贡献:
- ComfyUI - 强大的AI工作流平台
- comfyui_LLM_party - FLUX提示词模板参考
- ComfyUI_Custom_Nodes_AlekPet - 翻译节点参考
⚠️ 重要提示:
- 使用本项目需要相应的API密钥和网络连接
- 请确保遵守各AI服务提供商的使用条款和限制
- 建议在生产环境中使用前进行充分测试
💡 提示: 如果您觉得这个项目有用,请给我们一个⭐星标支持!
<img src="/image/微信图片_20250620124237.png" alt="ComfyUI LLM Banana" width="200px" />