Nodes/ComfyUI-NanoBanana2/NanoBanana - Vision OCR (lossless PNG)
ComfyUI Node

NanoBanana - Vision OCR (lossless PNG)

A ComfyUI node in NanoBanana2/Image with 7 inputs and 1 output.

By IxMxAMAR·Created 5 months ago·Updated 2 months ago· 4
NanoBanana - Vision OCR (lossless PNG)
  • image
  • network
  • text
api_key
modelgemini-2.5-pro
custom_model
modeplain_text
language_hint
CategoryNanoBanana2/Image

Inputs (7)

NameTypeDefaultDescription
api_keySTRING
modelCOMBOgemini-2.5-pro35 options: gemini-pro-latest, gemini-flash-latest, gemini-flash-lite-latest, gemini-3-pro-preview, gemini-3-flash-preview, gemini-3.1-pro-preview, +29
imageIMAGE
custom_modeloptSTRING
modeoptCOMBOplain_textOutput format. structured_json returns {lines: [{text, bbox, confidence}, ...]}.
language_hintoptSTRINGOptional language hint (e.g. 'Japanese', 'Hindi').
networkoptNB_NETWORKOptional. Wire a NanoBanana - Network Route node here to route this request through that proxy (e.g. US egress).

Outputs (1)

NameTypeDescription
textSTRING