Nodes/ComfyUI-API-Toolkit/Gemini Text-to-Speech
ComfyUI Node

Gemini Text-to-Speech

A ComfyUI node in API Toolkit/Gemini/Audio with 6 inputs and 1 output.

By IxMxAMAR·Created 5 months ago·Updated about a month ago· 1
Gemini Text-to-Speech
    • audio
    api_key
    modelgemini-2.5-flash-preview-tts
    text
    voiceKore
    custom_model
    style_prompt
    CategoryAPI Toolkit/Gemini/Audio

    Inputs (6)

    NameTypeDefaultDescription
    api_keySTRINGGemini API key. Leave blank to use GEMINI_API_KEY env var.
    modelCOMBOgemini-2.5-flash-preview-ttsTTS model. Pro = higher quality, Flash = faster.
    textSTRINGText to speak. Can include speaker tags for multi-speaker dialogue.
    voiceCOMBOKorePrebuilt voice. Each has different characteristics.
    custom_modeloptSTRING
    style_promptoptSTRINGOptional style instruction prepended to text (e.g., 'Say cheerfully:').

    Outputs (1)

    NameTypeDescription
    audioAUDIO