Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
MiniMax H3 本地部署 vs API:VRAM、速度、许可和成本
2026/08/23

MiniMax H3 本地部署 vs API:VRAM、速度、许可和成本

MiniMax 与 ComfyUI 官方文档能确认哪些 H3 本地硬件要求?对比官方工作流与托管 768P、2K API 成本。

当官方优化工作流适配你的硬件,而且你需要反复迭代或处理私密输入时,可以在本地运行 MiniMax H3;需要偶发成片、托管 2K 输出、并发或免配置时则使用 API。 ComfyUI 官方指南说明,动态卸载可让工作流在 RTX 3060 上启动,但能启动不等于速度基准,也不能证明不同 VRAM 档位会得到等效结果。[1]

“本地运行”必须同时说明三个数字:分辨率、时长和运行时间。否则,低内存启动和服务器部署看起来就像同一种结果。

本地 H3 当前意味着什么

配置官方记录的结果重要限制
官方优化的 ComfyUI 包模型总占用 42.5GB;动态卸载可在 RTX 3060 上启动启动不等于速度基准
官方 SGLang 示例使用四张 GPU 完整部署服务器路径,不是消费级单卡方案

ComfyUI 官方 H3 教程将原生 16:9 画布设为 1344×768,并打包剪枝后的 INT8 权重、NVFP4 文本编码器、独立的视频与音频 VAE,以及可选的 Turbo LoRA。[1] 官方优化把全精度占用从 123.6GB 降到 42.5GB。卸载可以把部分组件移到系统内存,让较小的显卡启动工作流,但不会让这些组件消失。

因此,仅凭 VRAM 容量无法判断本地工作流是否实用。分辨率、时长、运行时间和卸载量都必须写进同一份测试结果。

官方文档能确认哪些本地硬件信息

本文引用的官方资料只确认了两条具体部署路径:使用动态卸载的优化 ComfyUI 工作流,以及多 GPU 的 SGLang 示例。它没有发布可直接比较 8GB、12GB 与 24GB 消费级系统的性能表。

在把任何本地结果当作购买建议之前,先问三个直接问题:

  • 这个确切工作流能否在不触发显存不足错误的情况下加载?
  • 它会生成什么分辨率和时长,单次尝试需要多久?
  • 所需输出仅使用原生本地工作流,还是还依赖官方托管的上下文或再生成服务?

MiniMax 模型卡也区分了本地原生工作流和完整 2K 路径。公开的 2K 工作流会把本地部署与官方 Context-IR 或再生成 API 结合使用。[2] 因此,本地 768p 与托管 2K 是不同的输出产品,而不是同一任务的两种价格。

MiniMax H3 API 成本

价格核查日期:2026 年 8 月 23 日:

托管路由每秒5 秒15 秒
MiniMax 直连,768P$0.080$0.400$1.200
reAPI,768P$0.074$0.370$1.110
MiniMax 直连,2K$0.130$0.650$1.950
reAPI,2K$0.119$0.595$1.785

MiniMax 官方价单按输出时长计费。输入视频时长也按选定分辨率计费,前五张参考图片免费,之后的图片加收费用,音频参考免费。[3]

reAPI MiniMax H3 模型页 发布了独立的 768P 和 2K 费率。[4] 这些是有日期的数字,不是永久承诺;用实时页面作预算参考。

硬件损益平衡用尝试次数衡量

假设 H3 需要 $500 硬件升级。先忽略电力和配置时间。

  • 以 $1.11 的 15 秒 768P API 短片计,$500 可买到大约 450 次尝试。
  • 以 $1.785 的 15 秒 2K 短片计,可买到大约 280 次。
  • $1,000 的机器预算把这些数字推到 768P 约 900 次或 2K 约 560 次。

正确的单位是尝试次数,不是交付视频。如果一个接受的镜头需要五次生成,450 次尝试可能变成 90 个成片。本地生成在被拒片段主导工作负荷时收益最大。

当 GPU 已经在桌子上时,算术也会改变。购买成本已沉没,本地 H3 对无限低分辨率迭代、离线参考素材、自定义节点和完整工作流控制很快变得吸引。

当数量不规则、需要 2K 成品、多个任务无需占据工作站、或团队宁愿花 $0.37 测试提示而不是花周末调内存设置时,API 访问挣得它的成本。

买显卡前先查许可证

MiniMax H3 是开权重,不是 Apache 或 MIT 许可。当前社区许可排除了美国、欧盟、英国和韩国的适用地域,并指导那里的用户获取单独的书面授权。[5]

公开下载和部署权限是不同的问题。许可证还包含商业收入和署名条件。我们的 MiniMax H3 许可指南 解释了条款而不试图提供法律意见。

这个区别对自托管最重要,因为团队直接获取和操作权重。托管 API 是不同的契约路由,应在其服务条款下评估。

常见问题

MiniMax H3 能在 8GB VRAM 上运行吗?

本文引用的官方资料没有确认 8GB 配置的结果。ComfyUI 官方指南记录了通过动态卸载在 RTX 3060 上启动,但这并不能证明 8GB 配置的实际性能。

12GB VRAM 够 H3 吗?

本文引用的官方证据不足以断言所有 12GB 配置都适用。它展示的是一条经过特定优化和卸载的路径,而不是普遍的 12GB 性能保证。

本地 H3 免费吗?

没有按生成 API 账单,但硬件、电力、存储、配置时间和失败本地尝试仍有成本。社区许可也可能决定预期部署是否被允许。

什么时候 API 比本地 H3 更便宜?

对于新的 $500 硬件支出,当前损益平衡大约是 reAPI 上 450 次 15 秒 768P 尝试或 280 次 15 秒 2K 尝试,不计电力和配置时间。

本地 H3 能生成与托管 API 相同的 2K 输出吗?

不能通过基础原生 ComfyUI 工作流。MiniMax 把完整 2K 工作流描述为本地部署和官方 context 或再生成服务的组合。

References

  1. ComfyUI. MiniMax H3 官方教程。 2026 年 8 月 23 日检索自 docs.comfy.org
  2. MiniMaxAI. MiniMax H3 模型卡和部署示例。 2026 年 8 月 23 日检索自 huggingface.co
  3. MiniMax API. 按次付费定价。 2026 年 8 月 23 日检索自 platform.minimax.io
  4. reAPI. MiniMax H3 模型页和实时定价。 2026 年 8 月 23 日检索自 reapi.ai
  5. MiniMaxAI. MiniMax H3 社区许可。 2026 年 8 月 23 日检索自 huggingface.co