ComfyUI Node
Doubao视觉丨API
A ComfyUI node in QING/API with 10 inputs and 3 outputs.
Doubao视觉丨API
- image
- generated_text
- conversation_info
- total_tokens
◄text_input请描述这张图片的内容。►
◄platform火山引擎►
◄modelDoubao-1.5-vision-pro►
◄max_tokens4096►
◄history10►
◄temperature0.7►
◄top_p0.90►
◄image_qualityauto►
◄clear_historyfalse►
CategoryQING/API
Inputs (10)
| Name | Type | Default | Description |
|---|---|---|---|
| image | IMAGE | 输入要分析的图像 | |
| text_input | STRING | 请描述这张图片的内容。 | 输入要发送给Doubao视觉模型的文本问题,Doubao擅长图像理解、UI分析和视觉推理 |
| platform | COMBO | 火山引擎 | 选择API服务提供商 |
| model | COMBO | Doubao-1.5-vision-pro | 选择要使用的Doubao视觉模型 📋 模型特点: 🔸 Doubao-Seed-1.6:最新种子版本,全面提升的视觉理解能力 🔸 Doubao-Seed-1.6-thinking:思维链推理版本,擅长复杂视觉分析 🔸 Doubao-Seed-1.6-flash:快速响应版本,适合实时应用 🔸 Doubao-1.5-vision-pro:专业视觉版本,高精度图像理解 🔸 Doubao-1.5-UI-TARS:UI专用版本,擅长界面元素识别 💡 Doubao视觉模型在UI分析、文档理解、场景识别方面表现卓越 |
| max_tokens | INT | 40961–32768 | 模型生成文本时最多能使用的token数量 |
| history | INT | 101–25 | 保持的历史对话轮数 |
| temperatureopt | FLOAT | 0.70–2 | 控制生成文本的随机性 |
| top_popt | FLOAT | 0.900–1 | 控制生成文本的多样性 |
| image_qualityopt | COMBO | auto | 图像处理质量:auto(自动选择), low(低质量,速度快), high(高质量,精度高) |
| clear_historyopt | BOOLEAN | false | 是否清除历史对话记录 |
Outputs (3)
| Name | Type | Description |
|---|---|---|
| generated_text | STRING | — |
| conversation_info | STRING | — |
| total_tokens | INT | — |