
MiniMax H3 本地部署 vs API:VRAM、速度、许可和成本
MiniMax 与 ComfyUI 官方文档能确认哪些 H3 本地硬件要求?对比官方工作流与托管 768P、2K API 成本。
当官方优化工作流适配你的硬件,而且你需要反复迭代或处理私密输入时,可以在本地运行 MiniMax H3;需要偶发成片、托管 2K 输出、并发或免配置时则使用 API。 ComfyUI 官方指南说明,动态卸载可让工作流在 RTX 3060 上启动,但能启动不等于速度基准,也不能证明不同 VRAM 档位会得到等效结果。[1]
“本地运行”必须同时说明三个数字:分辨率、时长和运行时间。否则,低内存启动和服务器部署看起来就像同一种结果。
本地 H3 当前意味着什么
| 配置 | 官方记录的结果 | 重要限制 |
|---|---|---|
| 官方优化的 ComfyUI 包 | 模型总占用 42.5GB;动态卸载可在 RTX 3060 上启动 | 启动不等于速度基准 |
| 官方 SGLang 示例 | 使用四张 GPU 完整部署 | 服务器路径,不是消费级单卡方案 |
ComfyUI 官方 H3 教程将原生 16:9 画布设为 1344×768,并打包剪枝后的 INT8 权重、NVFP4 文本编码器、独立的视频与音频 VAE,以及可选的 Turbo LoRA。[1] 官方优化把全精度占用从 123.6GB 降到 42.5GB。卸载可以把部分组件移到系统内存,让较小的显卡启动工作流,但不会让这些组件消失。
因此,仅凭 VRAM 容量无法判断本地工作流是否实用。分辨率、时长、运行时间和卸载量都必须写进同一份测试结果。
官方文档能确认哪些本地硬件信息
本文引用的官方资料只确认了两条具体部署路径:使用动态卸载的优化 ComfyUI 工作流,以及多 GPU 的 SGLang 示例。它没有发布可直接比较 8GB、12GB 与 24GB 消费级系统的性能表。
在把任何本地结果当作购买建议之前,先问三个直接问题:
- 这个确切工作流能否在不触发显存不足错误的情况下加载?
- 它会生成什么分辨率和时长,单次尝试需要多久?
- 所需输出仅使用原生本地工作流,还是还依赖官方托管的上下文或再生成服务?
MiniMax 模型卡也区分了本地原生工作流和完整 2K 路径。公开的 2K 工作流会把本地部署与官方 Context-IR 或再生成 API 结合使用。[2] 因此,本地 768p 与托管 2K 是不同的输出产品,而不是同一任务的两种价格。
MiniMax H3 API 成本
价格核查日期:2026 年 8 月 23 日:
| 托管路由 | 每秒 | 5 秒 | 15 秒 |
|---|---|---|---|
| MiniMax 直连,768P | $0.080 | $0.400 | $1.200 |
| reAPI,768P | $0.074 | $0.370 | $1.110 |
| MiniMax 直连,2K | $0.130 | $0.650 | $1.950 |
| reAPI,2K | $0.119 | $0.595 | $1.785 |
MiniMax 官方价单按输出时长计费。输入视频时长也按选定分辨率计费,前五张参考图片免费,之后的图片加收费用,音频参考免费。[3]
reAPI MiniMax H3 模型页 发布了独立的 768P 和 2K 费率。[4] 这些是有日期的数字,不是永久承诺;用实时页面作预算参考。
硬件损益平衡用尝试次数衡量
假设 H3 需要 $500 硬件升级。先忽略电力和配置时间。
- 以 $1.11 的 15 秒 768P API 短片计,$500 可买到大约 450 次尝试。
- 以 $1.785 的 15 秒 2K 短片计,可买到大约 280 次。
- $1,000 的机器预算把这些数字推到 768P 约 900 次或 2K 约 560 次。
正确的单位是尝试次数,不是交付视频。如果一个接受的镜头需要五次生成,450 次尝试可能变成 90 个成片。本地生成在被拒片段主导工作负荷时收益最大。
当 GPU 已经在桌子上时,算术也会改变。购买成本已沉没,本地 H3 对无限低分辨率迭代、离线参考素材、自定义节点和完整工作流控制很快变得吸引。
当数量不规则、需要 2K 成品、多个任务无需占据工作站、或团队宁愿花 $0.37 测试提示而不是花周末调内存设置时,API 访问挣得它的成本。
买显卡前先查许可证
MiniMax H3 是开权重,不是 Apache 或 MIT 许可。当前社区许可排除了美国、欧盟、英国和韩国的适用地域,并指导那里的用户获取单独的书面授权。[5]
公开下载和部署权限是不同的问题。许可证还包含商业收入和署名条件。我们的 MiniMax H3 许可指南 解释了条款而不试图提供法律意见。
这个区别对自托管最重要,因为团队直接获取和操作权重。托管 API 是不同的契约路由,应在其服务条款下评估。
常见问题
MiniMax H3 能在 8GB VRAM 上运行吗?
本文引用的官方资料没有确认 8GB 配置的结果。ComfyUI 官方指南记录了通过动态卸载在 RTX 3060 上启动,但这并不能证明 8GB 配置的实际性能。
12GB VRAM 够 H3 吗?
本文引用的官方证据不足以断言所有 12GB 配置都适用。它展示的是一条经过特定优化和卸载的路径,而不是普遍的 12GB 性能保证。
本地 H3 免费吗?
没有按生成 API 账单,但硬件、电力、存储、配置时间和失败本地尝试仍有成本。社区许可也可能决定预期部署是否被允许。
什么时候 API 比本地 H3 更便宜?
对于新的 $500 硬件支出,当前损益平衡大约是 reAPI 上 450 次 15 秒 768P 尝试或 280 次 15 秒 2K 尝试,不计电力和配置时间。
本地 H3 能生成与托管 API 相同的 2K 输出吗?
不能通过基础原生 ComfyUI 工作流。MiniMax 把完整 2K 工作流描述为本地部署和官方 context 或再生成服务的组合。
References
- ComfyUI. MiniMax H3 官方教程。 2026 年 8 月 23 日检索自 docs.comfy.org
- MiniMaxAI. MiniMax H3 模型卡和部署示例。 2026 年 8 月 23 日检索自 huggingface.co
- MiniMax API. 按次付费定价。 2026 年 8 月 23 日检索自 platform.minimax.io
- reAPI. MiniMax H3 模型页和实时定价。 2026 年 8 月 23 日检索自 reapi.ai
- MiniMaxAI. MiniMax H3 社区许可。 2026 年 8 月 23 日检索自 huggingface.co
更多文章

如何免费使用 Seedance 2.0:真正可行的方法
2026 年真正可用的 Seedance 2.0 免费途径:Dreamina 每日额度、Krea 免费套餐、免费版限制,以及何时一美元 API 额度更划算。


Mammouth AI 定价计划与额度限制详解
Mammouth AI 定价详解:三层订阅计划对比、三小时额度重置规则、包含的 API 积分、按量付费方式、文件上限和最佳使用场景。


Seedance 2.5 vs 2.0:每 token 贵 53%
Seedance 2.5 BytePlus 定价为每百万 token $10.70。对标分析、token-token 转换、参考视频计费、当前 reAPI 价格。
