视频模型

MiniMax H3 加速Lora移植ComfyUI:4步生成提速近半,双时钟采样器明日开源

2026年8月7日0 次阅读
MiniMax H3 加速Lora移植ComfyUI:4步生成提速近半,双时钟采样器明日开源

3分钟看懂

一句话:MiniMax H3 的4步加速Lora已被T8star移植到ComfyUI,但4步模式音频会崩,当前推荐8步(约100秒/768p);明天将发布双时钟采样器,有望彻底解决4步音频问题。

核心变化:原版加速Lora不支持ComfyUI → T8修改版已支持;4步音频崩溃 → 暂用8步替代;双时钟采样器 → 明天开源,4步可用。

速度对比:8步约100秒(768p)| 4步约50-60秒(音频有问题,等双时钟采样器)

这是什么

MiniMax H3 的4步加速Lora(Turbo Lora)是一种蒸馏加速方案,可将原本需要数十步的视频生成压缩到4步完成,大幅缩短推理时间。但原版存在两个问题:

  1. 不支持ComfyUI——HuggingFace上原版Lora未适配ComfyUI的加载方式
  2. 音频崩溃——4步模式下,视频与音频的Shift参数不一致,导致最后一步音频输出严重失真(强烈噪音)

T8star 针对这两个问题分别做了修复和适配。

怎么用

当前推荐:8步模式

由于4步音频问题尚未完全解决,T8当前推荐使用8步:

  • 768分辨率、8步:约100秒完成
  • 4步(加速后):约50-60秒,但音频有问题,暂不推荐

8步相比4步还有一个额外好处:脸部生成质量更好。

必须遵守的设置

设置项推荐值注意
采样器Euler不要用默认的ARES采样器
SchedulerBeta
模型Into8 FRVA不要用ROM模型;多参模型尚未更新
精度FRVA模型BF16虽支持但FRVA更适配
跳步/跳层关闭8步模式下务必关闭

明天发布:双时钟采样器

T8预告明天将发布"双时钟采样器"节点,核心思路是为视频和音频分别使用不同的Shift/Schedule,从根本上解决4步模式下音频崩溃的问题。届时4步模式有望正常使用,速度还能进一步提升。

适用 / 不适用场景

✅ 适合

  • 已有8G+显存的ComfyUI用户想加速H3生成
  • 对音频质量要求不高、主要做视觉内容的场景
  • 愿意等双时钟采样器发布后再用4步的用户

❌ 不适合

  • 需要4步+高质量音频的音视频同步场景(等双时钟采样器)
  • 想开跳步/跳层进一步加速的用户(8步下不兼容)
  • 非ComfyUI用户(原版Lora在官方框架可用)

避坑提示

⚠️ 采样器选错会崩:必须用Euler,不要用默认ARES采样器

⚠️ 4步音频会炸:当前4步模式音频输出有强烈噪音,务必用8步

⚠️ 跳步/跳层不能开:8步模式下开跳步或跳层会导致画面崩坏

⚠️ 模型别选错:不要用ROM模型,用Into8的FRVA模型

成本与时间

显存需求:8G显存可跑(H3满血版最低要求)

8步生成时间:768分辨率约100秒

4步生成时间:约50-60秒(等双时钟采样器后可用)

Lora/节点:全部免费开源

行动建议

  1. 下载T8修改版加速Lora(HuggingFace或夸克网盘)
  2. 更新H3专用ComfyUI节点(十字于修改版,量化效果更好)
  3. 按上方设置表配置:Euler采样器 + Beta Scheduler + FRVA模型 + 关闭跳步跳层
  4. 先用8步跑通,确认效果后再等双时钟采样器发布切4步
  5. 关注T8明日视频,获取双时钟采样器节点

其他更新

  • H3专用ComfyUI节点:由十字于修改,专门针对H3优化(之前版本主要适配LTX),量化效果更好,推荐更新
  • 蒸馏后质量观察:T8指出蒸馏加速后质量反而可能更高,类似PC4、LightTV等蒸馏模型的经验——步数少但效果反而更"特化"

资源获取

来源说明

本文基于 T8star-Aix B站视频 BV1hFuE6tEvt 的本地ASR转写内容整理,视频发布于2026年8月6日。转写可能存在术语偏差,关键设置请以视频原声和作者评论区说明为准。

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...