专题 · h3-series

MiniMax H3 系列:从开源权重到 35 倍吞吐

MiniMax H3 自 2026 年 8 月开源以来节奏密集:官方把生成、参考与编辑收回一个模型;ComfyUI 当天压进 RTX 3060;摩尔线程 3 小时完成国产 GPU 适配;fal 后训练版把吞吐拉到 35 倍;FastH3 蒸馏再砍推理成本。本专题持续追踪 H3 的发布—开源—蒸馏—部署全链路。

7 篇·2026年8月2日 — 2026年8月30日·累计阅读 3.4k
diffusionefficiency··396

FastH3 开源:4 步蒸馏版 MiniMax H3,B200 单卡最高提速 14 倍

UCSD FastVideo 团队联合 NVIDIA FastGen、Nuva Lab 开源 FastH3 Preview v1:用 DMD2 蒸馏把 MiniMax H3 的 49 次 DiT 调用压到 4 次,叠加 90% 稀疏注意力,B200 单卡最高提速 14 倍,8…

h3-seriesinference··358

fal 后训练版 MiniMax H3:5 秒视频约 3 秒生成,吞吐 35 倍

fal 在开源 MiniMax H3 权重上后训练出 H3 Max:5 秒视频约 3 秒生成,吞吐约为官方端点 35 倍,人工偏好评测三项居首,Design Arena 独立评测也称其速度超 50 倍;但分辨率止步 768p,仅支持文生视频与图生视频。

ai-inferenceh3-series··187

MiniMax H3 开源实测:你下载的权重,和 API 里跑的不是同一个模型

MiniMax H3 权重 8 月 3 日登陆 Hugging Face 后,社区实测发现:开源版只包含 API 三步流水线中的 base generation 模块,提示词增强与 2K 超分仍是托管服务,稀疏注意力实现也未随首发放出。本地跑通原生 768p 之外,MLX…

h3-seriesmodel-release··207

MiniMax H3 首个商用落点:美图 RoboNeo 接入背后,通用多模态模型的"可编辑性"才刚开始被检验

8 月 3 日,美图旗下 RoboNeo 宣布接入 MiniMax 刚开源的多模态生成模型 MiniMax H3,主打多模态理解与精细化视频局部编辑。同日,摩尔线程基于 MTT S5000 完成 H3 的 Day-0 适配。从开源到商用、从训练到推理,H3…

h3-seriesmodel-release··212

MiniMax H3 不只是 2K 视频:它想把生成、参考和编辑收回一个模型

MiniMax 发布通用全模态视频模型 H3,把文本、图像、视频与音频统一为上下文,可生成最高 2K、最长 15 秒并带原生立体声的视频。它真正值得关注的不是规格,而是用 H3-VAE、Omni Transformer 与上下文再生成,把分裂的生成、参考和编辑任务收回一个模型。

ai-inferenceh3-series··1.9k

ComfyUI Day-0 跑通 MiniMax H3:把 2K 多模态视频生成压到 RTX 3060

MiniMax 开放权重发布 H3(Hailuo 3.0),ComfyUI 在发布当天通过 66% 显存压缩把 2K 多模态视频生成跑进消费级 GPU;Artificial Analysis 榜单显示 H3 在视频编辑方向排名第一,文生视频与图生视频分列第二、第三。

h3-serieshardware··219

MiniMax H3 三小时跑上 MTT S5000:Day-0 适配真正比拼的是软件栈

MiniMax H3 开源当天,摩尔线程称仅用 3 小时便在单机八卡 MTT S5000 节点完成稳定部署,串起 SGLang-MUSA、MATE、muDNN 与 MUSA Runtime。本文拆解这次 Day-0 适配的工程含义:国产 GPU…