视频模型

英伟达团队发布 MiniMax H3 Super Acceleration:5秒视频6秒多出片,T8 已复现开源到 ComfyUI

2026年9月3日2 次阅读
英伟达团队发布 MiniMax H3 Super Acceleration:5秒视频6秒多出片,T8 已复现开源到 ComfyUI

英伟达团队发布 MiniMax H3 Super Acceleration 加速方案:5秒768P视频只要6.85秒,T8 已复现并开源到 ComfyUI

导读:这篇讲什么

  • MiniMax H3 的视频生成速度之争又进一步:英伟达方面的团队发布了 H3 Super Acceleration 推理加速方法,在 GB200 处理器上跑出「5秒768P视频只要6.85秒、10秒只要14.93秒」的成绩。
  • B站up主 T8star-Aix 第一时间复现了这个方法,并开源到 ComfyUI 节点里:两阶段生成——先低分辨率快速出片,再用 LTX2.5 轻量 VAE 超分到 1080P。
  • 本地门槛没有想象中高:16G 显存实测 15秒1080P 视频约 200 秒出片,比原来的二采方案快了约三分之一。
  • 但要注意:官方宣传的"6秒出片"是 GB200 数据中心卡的成绩,本地玩家别多想;这套方案适合文戏,不适合高速动作场景。

视频里 T8 到底讲了什么

以下内容依据视频语音转写整理(T8 本条视频无官方字幕)。

1. 事件背景:H3 速度宣传与加速方法对上了

T8 开场提到,这两天 MiniMax H3 Max(fal 单独训练的版本)宣称「5秒视频只要3秒跑出来」,也有说6秒的,甚至还有直播演示。他判断这件事大概率是真的,但同时提出了关键问题:这到底是怎么达成的?

他把答案指向了 NVIDIA 方面实验室前几天发布的一个推理加速方法——两者说法一致:5秒钟768P的视频只要6.85秒,10秒是14.93秒

2. 先泼冷水:这是 GB200 的成绩

T8 特意强调:这不是本地能达到的速度。这个数字是在 NVIDIA 最好的处理器 GB200 上跑出来的,属于大公司数据中心设备的能力。「X上宣传6秒钟跑出来整套视频,核心问题是你得有GB200。所以英伟达看着在宣传开源技术,实际上是在卖他的显卡。」

3. 方法本身:两阶段 + 稀疏注意力

T8 复现后的方案拆解:

  • 第一阶段:低分辨率快速生成。按官方思路用不到480P的分辨率出片,这一步速度非常快,5秒视频本地约1分钟。
  • 第二阶段:超分放大到1080P。过去用二次采样(二采)方案,20分钟起步;现在换用 LTX2.5 加上几个轻量级 VAE,解码速度大幅提升。
  • 核心加速点:稀疏注意力(sparse attention)。跑的时长越长,加速越明显——显卡越好、视频越长,收益越大。
  • 保一致性:他单独做了手动 sigma 算法节点,让超分后画面和原视频基本保持一致,避免官方"从头来"方式导致人物一致性变化大。

4. 本地实测数字

  • 16G 显存(同时开着一堆东西):15秒1080P 约 200-220秒 出片,此前同样内容约 300秒
  • 5090 跑不到480P 的第一阶段,两三分钟内就能完成。
  • 整体速度提升约 25%-30%,显卡越好、时长越长,提速幅度越大。

5. 实操要点与坑

  • 二次采样时提示词要加细节词(如 8K、architectural detailed 等),否则清晰度上不去。
  • 音频部分没有重新采样,沿用之前方案。
  • RunningHub 在线版节点更新后"显示不报错了,跑起来报错",预计次日修复后可在线免费用。
  • 显卡越好第二阶段越快,但整体仍受限于第一阶段采样速度。

6. T8 的适用性判断

  • 适合:文戏。生成速度快,放大后人物人脸、清晰度都还可以,"也不油"。
  • 不适合:特别高速的打斗/动作场景。
  • 他还留了一句话:MiniMax 如果哪天真正开源视频模型本身,那才是真正的"王炸"——现在的加速技术只是提速手段。

放到更大的图景里:H3 加速生态这一周

基于多家媒体转述整理,MiniMax H3 的推理加速最近已经形成了多条并行路线,T8 的复现是社区侧的最新落地:

| 路线 | 主导方 | 关键数字 | 时间 |

|---|---|---|---|

| Super Acceleration(本篇) | NVIDIA 团队 / T8 复现 | GB200:5s/768P→6.85s;本地16G:15s/1080P≈200s | 2026-09-02 |

| FastH3 Preview | FastVideo + Nuva Lab + NVIDIA | 4步蒸馏替换49次调用 + 90%稀疏注意力,Blackwell单卡最高14x | 2026-08-28 |

| H3 Max | fal(后训练+推理协同) | 5秒视频约3秒出片,号称35x | 2026-08底 |

| SGLang 推理优化 | LMSYS/SGLang 社区 | 8×H200 无损1.95x,叠加 Cache-DiT/SubBlock 最高6.24x | 2026-08底 |

值得注意的是,社区对 FastH3 的"14x"并非全盘买账——有批评认为其速度提升部分来自画质妥协,MiniMax 官方也曾公开回应相关争议。对普通用户来说,与其盯单个倍率数字,不如像 T8 这样看本地同硬件的真实出片时间。

同一天,T8 还更新了什么

9月2日 T8 连发多条视频,都是围绕 H3 生态的开源动作:

  • 阿里开源新版 MiniMax H3 8步加速 Lora:T8 当晚第一时间做了 ComfyUI 配套模型、节点和工作流(Pai-8步T8版开源版),模型已传仓库。
  • IndexTTS 2.5 整合包更新:H3 数字人的"最佳伴侣",支持实时流式生成、小时级长音频分段修改、导演级可控时间轴调度、多种加速模式。
  • 另有 H3 混合效果模式(10Eros Hybrid Beta4 vs Dasiwa Hybrid 原生Turbo 8步)等横评内容。

谁该关注 / 怎么试

适合你,如果:

  • 你在本地用 ComfyUI 跑 MiniMax H3,显存 16G 以上,想明显缩短出片时间;
  • 你主要生成文戏类内容(对话、叙事、中远景人物);
  • 你想先用免费在线算力试效果,可以等 RunningHub 节点修复后(T8 预告次日可用,B站评论区有入口)。

暂缓,如果:

  • 你主要做高速动作/打斗类视频——这条路线对这类内容不友好;
  • 显存不足 16G——第一阶段虽然轻,但二采阶段吃显存;
  • 你期待"6秒出片"——那是 GB200 的成绩,本地请按 T8 的实测数字管理预期。

上手路径:T8 已把节点更新推送到仓库,配套模型上传到 GitHub(github.com/T8mars 系列:minimax-h3-prompt-skill-T8、comfyui-minimax-h3-prompt-enhancer-T8 等),工作流整合包见其视频描述区。ComfyUI 用户更新节点到最新版即可拿到新工作流。

避坑提示

  1. 别被"6秒"数字带节奏——先看清它是数据中心卡(GB200)的成绩,本地对照 16G≈200s/15s@1080P 更有参考价值。
  2. 手动 sigma 一定要设——按官方默认从头生成,人物一致性会明显变差。
  3. 二采提示词别偷懒——不加 8K/细节词,放大后清晰度提升有限。
  4. 文戏优先——高速动作场景目前这条加速路线会掉链子,先跑短片验证再上长片。
  5. 在线平台注意时差——RunningHub 版本今日还有报错,等全量更新后再用。

---

来源与说明

  • 本文主体依据 T8star-Aix 2026-09-02 视频的本地语音转写(SenseVoice 转写后人工整理)复原,视频无官方字幕;视频表述与数据(GB200 成绩、本地实测、sigma/细节词要点)均以转写为准。
  • 视频:[YouTube 链接](https://www.youtube.com/watch?v=ZLqHrghqbfE)(B站同步发布)
  • T8 开源仓库:github.com/T8mars 系列(prompt-skill / prompt-enhancer / blockcache / audio 节点)
  • 生态背景基于多家媒体转述整理:ComfyUI Wiki(FastH3 Preview,2026-08-28)、Kombitz(FastH3 14x,2026-08-30)、觉醒AI(SGLang 8×H200 实测)
  • 本文未获 MiniMax / NVIDIA / fal 官方逐字材料,官方口径以各官方渠道为准

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...