Skip to content

Latest commit

 

History

90 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 

Repository files navigation

MiniMax H3 Audio T8

MiniMax H3 的 ComfyUI 节点包:生成视频和声音,也支持参考控制、长视频、修脸和加速。

当前版本:1.50.0 · GPL-3.0-or-later

主要功能

  • 文生、图生、首尾帧、参考图/视频/音频、混合参考
  • 视频和音频双时钟采样
  • 原声保留、参考音频、音轨合成、低步数 Audio Refine
  • 多关键帧、长视频续写、断点恢复、Latent 放大
  • 单人/多人脸部修复、SAM3.1 追踪、Skin Finish
  • Prompt Relay、SPEED、SLA、PDD、Enhance-A-Video

AdvancedEXP 的节点属于高级/实验功能,建议直接使用配套工作流。

安装

在 ComfyUI Manager 搜索 MiniMax H3 Audio T8,安装后重启 ComfyUI。

手动安装:

cd ComfyUI/custom_nodes
git clone https://github.com/T8mars/comfyui-minimax-h3-audio-T8.git minimax-h3-audio-T8

快速开始

  1. 打开 examples/workflows
  2. 新用户先用 01-basic-generation02-audio-control
  3. 把 JSON 拖进 ComfyUI,替换模型和素材后运行。
  4. 高级工作流先看同目录的 README.md 和画布 NOTE。

查看全部工作流分类

模型目录

模型 放置目录
H3 主模型 models/diffusion_models
文本编码器 models/text_encoders
视频/音频 VAE models/vae
Turbo、SLA、PDD 等 LoRA models/loras
Latent 放大模型 models/latent_upscale_models

FL2VA、Ref2VA、pruned 和完整基模不要混用。

常用设置

  • Turbo 双时钟常用 shift:视频 12,音频 3
  • 保留原声:audio_mode=lock_source,保存节点连接 mux_audio
  • 媒体标签:<Picture 1><Video 1><Audio 1>,编号必须对应输入
  • 宽高使用 32 的倍数;显存不足时先降分辨率、帧数和参考数量
  • 不要同时叠加多个接管 sampler、attention 或 MODEL forward 的节点

PDD 8 步

工作流在 19-pdd-acceleration。PDD 必须使用专用节点,不能当普通 LoRA 加载。

转换后的 FL2VA / Ref2VA PDD 加速 LoRA 下载:t8star/MiniMax-H3-Acc-8Step-comfy。下载后放到 ComfyUI/models/loras,并选择与基模一致的版本。

默认:Euler/simple、8 NFE、shift 12 / 3、CFG 1。

目录中同时提供 FL2VA / Ref2VA 的学习型 latent 双采工作流:严格把同一条 PDD 轨迹分成 LOW 4 步和 HIGH 4 步,总 NFE 仍为 8。正式 Ref2VA 预设为 864×480×22、1.5×;FL2VA 双采暂保留实验标记。

常见问题

  • 参数错位或 NaN: 完整重启 ComfyUI,再重新载入工作流。
  • 媒体标签报错: 检查素材连接和标签编号。
  • 没有保留原声: 使用 lock_source,并连接 mux_audio
  • OOM: 关闭并发,降低分辨率/帧数,再逐个关闭高级节点排查。

文档与反馈

相关链接

模型和第三方组件遵循各自许可证;人物、声音和参考素材的使用权由使用者自行负责。

About

No description, website, or topics provided.

Resources

Stars

825 stars

Watchers

2 watching

Forks

Releases

Packages

Contributors

Languages