ComfyUI Node
Fal Image-to-Text
A ComfyUI node in Fal-Gateway with 6 inputs and 2 outputs.
Fal Image-to-Text
- image
- response
- info
◄model_id▾►
◄prompt►
◄system_prompt►
◄schema►
◄seed-1►
CategoryFal-Gateway
Inputs (6)
| Name | Type | Default | Description |
|---|---|---|---|
| model_id | COMBO | 11 options: [fal-ai] Florence 2 Large Detailed Caption, [fal-ai] LLaVA v1.6 34B, [fal-ai] Marlin, [fal-ai] Marlin Find, [fal-ai] Moondream2, [fal-ai] Moondream3 Preview [Caption], +5 | |
| prompt | STRING | — | |
| system_prompt | STRING | — | |
| schema | STRING | — | |
| seed | INT | -1-1–4294967295 | — |
| image | IMAGE | — |
Outputs (2)
| Name | Type | Description |
|---|---|---|
| response | STRING | — |
| info | STRING | — |