FastH3 开源:4 步蒸馏版 MiniMax H3,B200 单卡最高提速 14 倍
UCSD FastVideo 团队联合 NVIDIA FastGen、Nuva Lab 开源 FastH3 Preview v1:用 DMD2 蒸馏把 MiniMax H3 的 49 次 DiT 调用压到 4 次,叠加 90% 稀疏注意力,B200 单卡最高提速 14 倍,8…
MiniMax H3 自 2026 年 8 月开源以来节奏密集:官方把生成、参考与编辑收回一个模型;ComfyUI 当天压进 RTX 3060;摩尔线程 3 小时完成国产 GPU 适配;fal 后训练版把吞吐拉到 35 倍;FastH3 蒸馏再砍推理成本。本专题持续追踪 H3 的发布—开源—蒸馏—部署全链路。
UCSD FastVideo 团队联合 NVIDIA FastGen、Nuva Lab 开源 FastH3 Preview v1:用 DMD2 蒸馏把 MiniMax H3 的 49 次 DiT 调用压到 4 次,叠加 90% 稀疏注意力,B200 单卡最高提速 14 倍,8…
fal 在开源 MiniMax H3 权重上后训练出 H3 Max:5 秒视频约 3 秒生成,吞吐约为官方端点 35 倍,人工偏好评测三项居首,Design Arena 独立评测也称其速度超 50 倍;但分辨率止步 768p,仅支持文生视频与图生视频。
MiniMax H3 权重 8 月 3 日登陆 Hugging Face 后,社区实测发现:开源版只包含 API 三步流水线中的 base generation 模块,提示词增强与 2K 超分仍是托管服务,稀疏注意力实现也未随首发放出。本地跑通原生 768p 之外,MLX…
8 月 3 日,美图旗下 RoboNeo 宣布接入 MiniMax 刚开源的多模态生成模型 MiniMax H3,主打多模态理解与精细化视频局部编辑。同日,摩尔线程基于 MTT S5000 完成 H3 的 Day-0 适配。从开源到商用、从训练到推理,H3…
MiniMax 发布通用全模态视频模型 H3,把文本、图像、视频与音频统一为上下文,可生成最高 2K、最长 15 秒并带原生立体声的视频。它真正值得关注的不是规格,而是用 H3-VAE、Omni Transformer 与上下文再生成,把分裂的生成、参考和编辑任务收回一个模型。
MiniMax 开放权重发布 H3(Hailuo 3.0),ComfyUI 在发布当天通过 66% 显存压缩把 2K 多模态视频生成跑进消费级 GPU;Artificial Analysis 榜单显示 H3 在视频编辑方向排名第一,文生视频与图生视频分列第二、第三。
MiniMax H3 开源当天,摩尔线程称仅用 3 小时便在单机八卡 MTT S5000 节点完成稳定部署,串起 SGLang-MUSA、MATE、muDNN 与 MUSA Runtime。本文拆解这次 Day-0 适配的工程含义:国产 GPU…