Extensions/ComfyUI-Tlant-Toolkit
ComfyUI Extension

ComfyUI-Tlant-Toolkit

Small utility nodes for ComfyUI workflows.

By Tlant·Created 2 months ago·Updated 3 days ago· 0
Tlant/ComfyUI-Tlant-Toolkit
Nodes
On cloudLocal install
Stars0
Updated3 days ago
Readme

ComfyUI-Tlant-Toolkit

Small utility nodes for ComfyUI workflows.

Nodes

  • Load File Batch (Tlant): selects one file from a folder by fixed index, incremental counter, or seed-stable random choice, and outputs the absolute path plus filename metadata.
  • Random Line (No Seed) (Tlant): selects a non-empty line from a connected multiline string on every execution without a seed or control-after-generate widget.
  • Random Lines (Tlant): adds another string output whenever the trailing output is connected and randomly fills all connected outputs. 是否重复 defaults to ; disabled sampling uses distinct line positions, while enabled sampling allows the same line position more than once. Requesting more outputs than non-empty input lines raises an error in either mode.
  • MiniMax H3提示词扩写指令·简单模式(Tlant): 使用少量常用中文选项生成完整、无状态的 MiniMax H3 I2VA 扩写指令。
  • MiniMax H3高级配置·基础生成(Tlant): 配置时长、画幅、主题和创意策略。
  • MiniMax H3高级配置·人物一致性(Tlant): 配置身份、人脸、视线和表情稳定性。
  • MiniMax H3高级配置·人物动作(Tlant): 配置姿势、手脚、移动和舞蹈动作。
  • MiniMax H3高级配置·镜头剪辑(Tlant): 配置分镜、切镜、运镜和焦点变化。
  • MiniMax H3高级配置·场景效果(Tlant): 配置背景、光线、物理动态和视觉效果。
  • MiniMax H3高级配置·音频(Tlant): 配置 MiniMax H3 原生环境声、动作音、音乐和对白。
  • MiniMax H3提示词扩写指令·高级汇总(Tlant): 汇总高级配置;未连接的分类使用 seed 生成可复现随机值。
  • MiniMax H3提示词扩写指令 V2·完整模式(Tlant): 将人物一致性、剪辑、运镜、场景和音频选项集中在一个节点中,不使用本地随机。
  • MiniMax H3提示词扩写指令 V2·简单基础版(Tlant): 只显示常用 V2 选项;未显示或选择“不指定”的元素不会写入指令。

MiniMax H3 提示词扩写

这些节点用于将写实静态人物图或上游反推的图片描述,转换成发送给远程 LLM 的完整无状态扩写指令。远程 LLM 的输出被约束为干净的英文 MiniMax H3 I2VA 提示词,可直接连接到本地 MiniMax H3 工作流。

简单模式

使用 MiniMax H3提示词扩写指令·简单模式(Tlant):设置时长、画幅、主题、动作幅度、人脸保护、切镜、镜头动感、音频、音乐与 seed 即可。未展示的高级参数会由节点按 seed 稳定随机抽取。

高级模式

将需要的 MiniMax H3高级配置 节点连接到 MiniMax H3提示词扩写指令·高级汇总(Tlant)。任何未连接的分类都会按汇总节点的 seed 抽取随机值,因此可以只精确控制一部分配置。

图像与文本输入

两个模式均可接收 IMAGESTRING 类型的图像描述。连接 IMAGE 时会原样透传给后续视觉 LLM,并在指令中明确要求以实际图像为最高依据;STRING 仅作为辅助信息。未连接图像时,必须提供图像描述。

可复现随机

所有“随机”选项通过 seed + 字段名 独立采样。将 ComfyUI 的 seed 控制设为 fixed 后,相同输入和 seed 会得到相同的选项组合;改变一个字段不会扰乱其他字段的随机结果。

V2 模式

V2 作为独立节点与原有 V1 并存,不修改 V1 的高级配置节点和可复现随机逻辑。V2 提供“完整模式”和“简单基础版”两个单节点版本,均输出供无状态远程 LLM 使用的 STRING 扩写指令,并透传可选的 IMAGE

两个 V2 节点共同提供:

  • 4–15 秒视频时长。
  • 主题预设和自定义主题;自定义主题非空时完全覆盖预设。
  • 图片和图片描述双输入;有图片时以图片为最高依据。
  • 提示词长度最小值 整数输入,默认要求最终英文 H3 提示词不少于 200 words。
  • 中文选项、中文悬停提示,以及严格的 MiniMax H3 I2VA 三字段输出语法。

V2 所有可选元素都包含以下三个公共值:

  • 不指定:默认值,该元素不会进入用户选择配置。
  • :明确禁止该元素;对于无法真正消失的属性,解释为不主动改变并保持原图状态。
  • 自行推断:要求远程 LLM 结合图片、主题、时长和其他明确设置进行安全判断。

V2 不包含本地 seed 或随机抽取。简单基础版没有展示的完整模式选项不会被补齐,也不会出现在扩写指令里。

V2 音频保护

背景音乐采用显式启用策略。只有选择“音乐”“完整混音”“音乐启用:是”、具体音乐参数,或者将音乐参数设为“自行推断”时,远程 LLM 才允许生成背景音乐;其他情况强制输出 non_diegetic_music: N/A。静音和明确关闭音乐拥有更高优先级。

对白默认关闭,不会自动虚构说话、演唱、旁白或画面文字。完整模式和简单基础版都提供环境声、对白、声音风格三个预设,以及对应的自定义文本框。自定义文本非空时完全覆盖对应预设。

V2 完整模式

完整模式在一个节点中集中提供以下类别:

  • 人物身份、面部动作、头部动作、面部朝向、视线和表情。
  • 切镜、镜头数量、景别、节奏、转场、连续性和结尾。
  • 官方运镜类型、幅度、速度、能量、手持感、轴线、景深和运动模糊。
  • 背景、场景扩展、光线、氛围、头发、服装、视觉特效和环境事件。
  • 环境声、动作音效、背景音乐、对白、语言、声音风格和口型同步。

V2 简单基础版

简单基础版只提供面部朝向、视线、表情、切镜、结尾、运镜、背景、头发、服装、环境事件及常用音频控制。它同样支持自定义环境声、自定义对白和自定义声音风格,但不会在后台添加完整模式中的其他配置。