Skip to content

Repository files navigation

ComfyUI MiniMax H3 Director

基于 ComfyUI 官方 MiniMax-H3 的多段音视频导演台插件。仓库地址:AIMixer/ComfyUI_MiniMaxH3_Director

EnglishREADME_EN.md

MiniMaxH3Director 工作流截图

功能介绍

MiniMaxH3Director 是面向长视频、多段生成的 MiniMax H3 导演台节点,把分段计划、条件编码、采样解码和导出整合在一个节点里。底层走官方 MiniMaxH3ImageToVideo / MiniMaxH3ReferenceToVideo + MiniMaxH3SigmaShift + KSampler + AV 分离解码链路,原生输出立体声音频。

核心能力

功能 说明
多段时间轴 节点内上传视频,支持切分、均分、智能分镜分割(PySceneDetect)、追加;分割点可选中删除;可视化时间轴预览每段范围与缩略图
多任务模式 task_typet2v(文生视频)、i2v(图生视频)、fl2v(首尾帧生视频)、r2v(参考主体生视频 / 素材组)、v2v(视频转视频)、rv2v(参考素材改视频)
首尾帧 (fl2v) 独立首尾帧时间轴:多组关键帧、「添加一组」上传首帧和/或尾帧(官方支持只传尾帧);拖缘调时长;提示词写中间运动;支持「选择运行」只跑部分组
参考素材组 (r2v) fl2v 式分组 UI:上方「公共参数」共享参考图/音频与公共提示词(与每组提示词拼接);每组可再挂图片1–9 / 音频1–3 / 视频1–3;提示词用 <Picture N> / <Video K> / <Audio J>(或 @ 引用);时间轴预览与选中状态同步
源视频编辑 (v2v / rv2v) Bernini 风格源视频时间轴;每段源画面自动绑定 <Video 1>rv2v 另可挂参考图(图片1–9)与参考音频(音频1–3)
选择运行 开启后只采样勾选的片段/素材组;未勾选段可用缓存或源画面填充(全部导出时)
外部多组接线 Director Group (Image to Video) / (Reference to Video) + Groups Combine;连入导演台 i2v_groups / r2v_groups 后外部优先覆盖 UI 素材,仍支持跑批与选择运行
原生立体声音频 与画面同次采样生成;v2v/rv2v 可选生成声音 / 使用原声 / 静音
段间引导 默认关闭;多段 t2v / i2v / fl2v / r2v / v2v / rv2v 时可开启,将上一段生成结果的末尾运动(及生成音频)钉入下一段采样再裁掉前缀。上下文帧数:5 / 22 / 39 / 56,默认推荐为 22感谢 ComfyUI-H3-Motion-Context 提供的实现思路
运行报告 report 口输出分段计划、每段任务摘要

输入 / 输出

输入: modelvideo_vaeaudio_vaeclip
可选: i2v_groups(Image to Video 多组)/ r2v_groups(Reference to Video 多组)

输出: imagesaudiofpsframe_countsource_imagesreport

CLIP Loader 的 type 必须选 minimax(Qwen3-VL)。
t2v / i2v / fl2vfl2va UNET;r2v / v2v / rv2vref2va UNET。

依赖

请将 ComfyUI 升级到 v0.30.0 及以上(含官方 MiniMax H3 节点:PR #15224PR #15228)。

可选:scenedetect(智能分割)、opencv-python-headless(源视频解码)、imageio-ffmpeg(原声抽取)——见 requirements.txt

安装

方法一:手动安装(标准方式)

cd ComfyUI/custom_nodes
git clone https://github.com/AIMixer/ComfyUI_MiniMaxH3_Director.git

pip install -r ComfyUI_MiniMaxH3_Director/requirements.txt

重启 ComfyUI。

方法二:ComfyUI Manager

  1. 打开 ComfyUI Manager
  2. 选择 Install via Git URL
  3. 填入 https://github.com/AIMixer/ComfyUI_MiniMaxH3_Director.git 并安装
  4. 重启 ComfyUI

模型与工作流下载

完整资源包(MiniMax H3 模型权重 + 示例 JSON 工作流)见:

Comfyit 搅拌站 · 文章 506:MiniMax H3 模型和工作流

下载后将 models/ 合并到 ComfyUI/models/,JSON 工作流拖入 ComfyUI 即可。

也可参考:

本仓库自带示例:example_workflows/

工作流 task_type UNET 说明
minimax_h3_director_t2v.json t2v fl2va 文生音视频
minimax_h3_director_fl2v.json fl2v fl2va 首尾帧(「添加一组」)
minimax_h3_director_r2v.json r2v ref2va 参考改视频素材组
minimax_h3_director_v2v.json v2v ref2va 源视频时间轴编辑
minimax_h3_director_rv2v.json rv2v ref2va 源视频 + 参考图/音频
minimax_h3_director_external_groups_i2v.json fl2v fl2va 外部 Group×2 → Combine → i2v_groups
minimax_h3_director_external_groups_r2v.json r2v ref2va 外部 Group×N → Combine → r2v_groups

推荐模型文件

用途 文件名 目录
UNET (t2v / i2v / fl2v) minimax_h3_fl2va_pruned_int8_convrot.safetensors models/diffusion_models/
UNET (r2v / v2v / rv2v) minimax_h3_ref2va_pruned_int8_convrot.safetensors models/diffusion_models/
CLIP qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors models/text_encoders/
Video VAE minimax_h3_video_vae_fp16.safetensors models/vae/
Audio VAE minimax_h3_audio_vae_fp32.safetensors models/vae/

快速开始

  1. 确认 ComfyUI ≥ 0.30.0,已能加载官方 MiniMax H3 节点
  2. 文章 506 或本仓库 example_workflows/ 加载示例
  3. 连接 UNET / CLIP / video_vae / audio_vae,在导演台 UI 内编辑时间轴与提示词后 Queue

视频教程: B 站合集 · 插件使用教程

默认采样参数

  • 画布默认 0.4MP 16:9(864×480)5 秒 / 124 帧 @ 24 fps(17k+5 网格)
  • 25 steps,res_multistep + simple,CFG 1.0
  • Sigma shift:video 12 / audio 3

首尾帧 fl2v 用法摘要

  1. 任务类型选 「首尾帧生视频 (fl2v)」
  2. 点击「添加一组」,上传首帧和/或尾帧(可只传尾帧)
  3. 在镜卡片或时间轴上调整时长;提示词写中间运动 / 镜头 / 过渡
  4. Queue 生成;多组可勾选「选择运行」只跑部分组

参考主体 r2v 用法摘要

  1. 任务类型选 「参考主体生视频 (r2v)」(需 ref2va UNET + audio_vae)
  2. 点击 「启用公共参数」 展开面板(默认折叠/关闭);上传共用参考图/音频并写公共提示词(如角色锁定 / subject_definitions);启用后会与每组提示词拼接
  3. 点击「添加素材组」;每组写分镜提示词,可按需再挂本组独有素材(同槽位覆盖公共素材)
  4. 提示词中用 <Picture N> / <Video K> / <Audio J>,或输入 @(启用公共参数时可引用公共 + 本组素材)
  5. 时间轴可预览各组时长与缩略图;「选择运行」与素材组勾选同步

源视频 v2v / rv2v 用法摘要

  1. v2vrv2v,上传源视频并分段(切分 / 均分 / 智能分割)
  2. 每段写提示词;系统自动将源片段绑定为 <Video 1>
  3. rv2v 可额外上传参考图 / 参考音频;声音模式可选生成 / 原声 / 静音

外部多组接线(第三方节点接入)

对齐官网两个 conditioning 节点,把扩写 / 抠图 / Load Video 等处理结果以多组形式送进导演台:

  1. 添加 MiniMax H3 Director Group (Image to Video)(Reference to Video)
  2. 按组接线:prompt / duration_sec;I2V 系接 first_frame / last_frame(无帧=t2v,仅首=i2v,仅尾或首+尾=fl2v);R2V 为 Autogrow(同官方 Reference to Video):接图/视频/音频会自动多出空口(图≤9、视频≤3、音频≤3)。输出宽高在导演台统一设置
  3. 多组:用 Director Groups Combine(Autogrow:接满最后一个口会自动多出新口,同官方 Reference to Video)→ 导演台 i2v_groups / r2v_groups;单组可直接把 group 连到导演台
  4. 导演台 task_type 与口一致(t2v/i2v/fl2v ↔ i2v_groups;r2v ↔ r2v_groups);不要两口同时连接
  5. 连接后执行以图中接线为准(外部优先);UI 卡片变淡,仍可用「选择运行」按组序勾选

配套生态 · Comfyit 搅拌站

Comfyit 提供环境、模型、工作流与教程配套:

栏目 链接
模型 / 工作流包 comfyit.cn/article/506
官方 MiniMax H3 文档 docs.comfy.org · MiniMax H3
插件视频教程 B 站合集
产品中心 comfyit.cn/products
插件广场 comfyit.cn/plugins
模型广场 comfyit.cn/resources/models
工作流广场 comfyit.cn/workflows

作者与交流

维护者 AI搅拌手 / AIMixer
本仓库 github.com/AIMixer/ComfyUI_MiniMaxH3_Director
姊妹插件 ComfyUI_Bernini_Director
作者 QQ 3697688140
B 站 space.bilibili.com/1997403556
插件教程 B 站合集 · 使用教程
QQ 交流群 551482703 · 425064221 · 559826331
Comfyit 搅拌站 comfyit.cn

致谢

许可证

Apache-2.0

About

Multi-segment MiniMax H3 Director for official ComfyUI MiniMax-H3

Resources

Stars

324 stars

Watchers

2 watching

Forks

Releases

Packages

Contributors

Languages