ComfyUI-Tlant-Toolkit
Small utility nodes for ComfyUI workflows.
ComfyUI-Tlant-Toolkit
Small utility nodes for ComfyUI workflows.
Nodes
Load File Batch (Tlant): selects one file from a folder by fixed index, incremental counter, or seed-stable random choice, and outputs the absolute path plus filename metadata.Random Line (No Seed) (Tlant): selects a non-empty line from a connected multiline string on every execution without a seed or control-after-generate widget.Random Lines (Tlant): adds another string output whenever the trailing output is connected and randomly fills all connected outputs.是否重复defaults to否; disabled sampling uses distinct line positions, while enabled sampling allows the same line position more than once. Requesting more outputs than non-empty input lines raises an error in either mode.MiniMax H3提示词扩写指令·简单模式(Tlant): 使用少量常用中文选项生成完整、无状态的 MiniMax H3 I2VA 扩写指令。MiniMax H3高级配置·基础生成(Tlant): 配置时长、画幅、主题和创意策略。MiniMax H3高级配置·人物一致性(Tlant): 配置身份、人脸、视线和表情稳定性。MiniMax H3高级配置·人物动作(Tlant): 配置姿势、手脚、移动和舞蹈动作。MiniMax H3高级配置·镜头剪辑(Tlant): 配置分镜、切镜、运镜和焦点变化。MiniMax H3高级配置·场景效果(Tlant): 配置背景、光线、物理动态和视觉效果。MiniMax H3高级配置·音频(Tlant): 配置 MiniMax H3 原生环境声、动作音、音乐和对白。MiniMax H3提示词扩写指令·高级汇总(Tlant): 汇总高级配置;未连接的分类使用 seed 生成可复现随机值。MiniMax H3提示词扩写指令 V2·完整模式(Tlant): 将人物一致性、剪辑、运镜、场景和音频选项集中在一个节点中,不使用本地随机。MiniMax H3提示词扩写指令 V2·简单基础版(Tlant): 只显示常用 V2 选项;未显示或选择“不指定”的元素不会写入指令。
MiniMax H3 提示词扩写
这些节点用于将写实静态人物图或上游反推的图片描述,转换成发送给远程 LLM 的完整无状态扩写指令。远程 LLM 的输出被约束为干净的英文 MiniMax H3 I2VA 提示词,可直接连接到本地 MiniMax H3 工作流。
简单模式
使用 MiniMax H3提示词扩写指令·简单模式(Tlant):设置时长、画幅、主题、动作幅度、人脸保护、切镜、镜头动感、音频、音乐与 seed 即可。未展示的高级参数会由节点按 seed 稳定随机抽取。
高级模式
将需要的 MiniMax H3高级配置 节点连接到 MiniMax H3提示词扩写指令·高级汇总(Tlant)。任何未连接的分类都会按汇总节点的 seed 抽取随机值,因此可以只精确控制一部分配置。
图像与文本输入
两个模式均可接收 IMAGE 和 STRING 类型的图像描述。连接 IMAGE 时会原样透传给后续视觉 LLM,并在指令中明确要求以实际图像为最高依据;STRING 仅作为辅助信息。未连接图像时,必须提供图像描述。
可复现随机
所有“随机”选项通过 seed + 字段名 独立采样。将 ComfyUI 的 seed 控制设为 fixed 后,相同输入和 seed 会得到相同的选项组合;改变一个字段不会扰乱其他字段的随机结果。
V2 模式
V2 作为独立节点与原有 V1 并存,不修改 V1 的高级配置节点和可复现随机逻辑。V2 提供“完整模式”和“简单基础版”两个单节点版本,均输出供无状态远程 LLM 使用的 STRING 扩写指令,并透传可选的 IMAGE。
两个 V2 节点共同提供:
- 4–15 秒视频时长。
- 主题预设和自定义主题;自定义主题非空时完全覆盖预设。
- 图片和图片描述双输入;有图片时以图片为最高依据。
提示词长度最小值整数输入,默认要求最终英文 H3 提示词不少于 200 words。- 中文选项、中文悬停提示,以及严格的 MiniMax H3 I2VA 三字段输出语法。
V2 所有可选元素都包含以下三个公共值:
不指定:默认值,该元素不会进入用户选择配置。无:明确禁止该元素;对于无法真正消失的属性,解释为不主动改变并保持原图状态。自行推断:要求远程 LLM 结合图片、主题、时长和其他明确设置进行安全判断。
V2 不包含本地 seed 或随机抽取。简单基础版没有展示的完整模式选项不会被补齐,也不会出现在扩写指令里。
V2 音频保护
背景音乐采用显式启用策略。只有选择“音乐”“完整混音”“音乐启用:是”、具体音乐参数,或者将音乐参数设为“自行推断”时,远程 LLM 才允许生成背景音乐;其他情况强制输出 non_diegetic_music: N/A。静音和明确关闭音乐拥有更高优先级。
对白默认关闭,不会自动虚构说话、演唱、旁白或画面文字。完整模式和简单基础版都提供环境声、对白、声音风格三个预设,以及对应的自定义文本框。自定义文本非空时完全覆盖对应预设。
V2 完整模式
完整模式在一个节点中集中提供以下类别:
- 人物身份、面部动作、头部动作、面部朝向、视线和表情。
- 切镜、镜头数量、景别、节奏、转场、连续性和结尾。
- 官方运镜类型、幅度、速度、能量、手持感、轴线、景深和运动模糊。
- 背景、场景扩展、光线、氛围、头发、服装、视觉特效和环境事件。
- 环境声、动作音效、背景音乐、对白、语言、声音风格和口型同步。
V2 简单基础版
简单基础版只提供面部朝向、视线、表情、切镜、结尾、运镜、背景、头发、服装、环境事件及常用音频控制。它同样支持自定义环境声、自定义对白和自定义声音风格,但不会在后台添加完整模式中的其他配置。