Nodes/ComfyUI_MinimaxH3_AutoContext/Minimax_H3_AutoContext_parameter
ComfyUI Node

Minimax_H3_AutoContext_parameter

H3 参数组:集中管理分段/分辨率/音频等参数,输出 parameter 供主节点使用,并预览预计分段

By supElement·Created 15 days ago·Updated about 16 hours ago· 2
Minimax_H3_AutoContext_parameter
    • parameter
    long_prompt
    prompt_modeauto
    clip_modeClip_Frame
    clip_tag段1
    prompt_formatofficial
    crop_modestretch
    ref_sync_modesegmented
    width960
    height544
    total_frames362
    fps24
    chunk_frames90
    context_frames22
    lock_audiotrue
    audio_drivefalse
    CategoryMinimaxH3_AutoContext

    Inputs (15)

    NameTypeDefaultDescription
    long_promptSTRING提示词 (传给主节点推理,同时用于「预计分段」预览)
    prompt_modeCOMBOauto提示词时间轴模式 (仅 Clip_Frame 模式生效,Clip_Tag 模式下自动忽略)。auto: 段落含时间标记(如0-5s)自动切分,无标记的段落(风格/音效/禁止项)自动拼入每个窗口; timeline: 强制按时间标记切分; global: 整段提示词用于所有窗口(适合全程同质动作); sequential: 按句读顺序铺到时间轴,以 '全局:'/'[全局]'/'[global]' 开头的段落不平铺、拼入每个窗口
    clip_modeCOMBOClip_Frame分段模式。Clip_Frame: 按 chunk_frames 均匀切分视频时间轴,提示词按时间标记匹配各窗口 (原有逻辑); Clip_Tag: 按用户自定义标签切分提示词,每段=一个 chunk=该段全部提示词,段时长由提示词内容决定
    clip_tagSTRING段1Clip_Tag 模式的分割标签模板 (仅 Clip_Tag 模式生效)。必须以数字序号结尾,如 '段1' (前缀'段'+1位数字)、'A01' (前缀'A'+2位数字)、'[片段001]' (前缀'[片段'+3位数字+后缀']')。提示词中标签独占一行才作为分割点,标签后推荐换行,不换行时跳过分隔符 (::,,。;; —–- 空格) 取段内容。推理时标签本身会被去除。提示词内时间写法保持秒不变
    prompt_formatCOMBOofficial提示词输出格式。official: [Shot N] At MM:SS.mmm + <Picture N>/<Video N>/<Audio N> 标签 + 官方字段名 (MiniMax H3 官方训练格式,推荐); legacy: 【0-3秒】+ 引用保持原写法(1基) + 块标题 (旧格式); raw: 完全不处理引用,去标签后原样输出,不做任何时间标记转换 (Clip_Tag 模式专用,保留段内相对时间原样)
    crop_modeCOMBOstretch参考图/首尾帧/参考视频的缩放裁剪模式。center: 等比例缩放并中心裁剪到目标尺寸; stretch: 直接拉伸到目标尺寸; none: 保持原始分辨率,仅做 32 对齐 (高级用户选项,ref2va 场景使用,尺寸问题用户自行处理)
    ref_sync_modeCOMBOsegmented参考视频/音频是否按生成段的时间范围切片。global: 每段使用完整参考视频/音频 (默认); segmented: 每段只取参考视频/音频中对应时间片段,用于替换人物并保持口型同步等场景
    widthINT96064–4096
    heightINT54464–4096
    total_framesINT3625–2880生成总帧数,需满足 17n+5 (5,22,39,56,73,90,...)。提示词内时间仍按秒解析
    fpsINT248–60帧率,仅用于音频同步和提示词内秒数换算
    chunk_framesINT905–2880每段生成帧数,需满足 17n+5 (5,22,39,...)。设为 ≥ total_frames 时不拆分,整个视频作为一段生成
    context_framesINT225–124段间续接用的上一段尾部帧数。值越大连续性越强。建议 22 以上防硬切。有效网格点: 5,22,39,56,73,90,107,124
    lock_audioBOOLEANtrue二采时锁定音频区 (noise_mask audio=0):只重新采样视频、保持一采音频不变。仅在连接 latent_input 时生效
    audio_driveBOOLEANfalse音频驱动开关。勾选后把 drive_audio 编码后锁进 latent (noise_mask=0,不重新生成音频),视频照它生成。注意:本节点不输出音频,请把同一条源音频直接接到视频合成节点 (这样也避免了 VAE 有损往返)。不勾选 (默认): 音频照常生成

    Outputs (1)

    NameTypeDescription
    parameterDICT