
MiniMax H3 ローカル vs API:VRAM と料金の比較
MiniMaxとComfyUIの公式文書から、H3のローカル実行環境について何が分かるのか。公式ワークフローとホスト型768P・2K APIのコストを比較します。
公式の最適化ワークフローが手元のハードウェアに適合し、反復生成や非公開入力が必要ならMiniMax H3をローカルで実行し、完成クリップを時々作る場合、ホスト型2K出力、並列実行、設定不要の運用が必要ならAPIを使います。 ComfyUIの公式ガイドでは、動的オフロードによってRTX 3060でワークフローを起動できるとしています。ただし、起動できることは速度ベンチマークでも、異なるVRAM容量で同等の結果が得られる証明でもありません。[1]
「ローカルで動く」という表現には、解像度、動画の長さ、実行時間の3つの数値が必要です。これらがなければ、低メモリ環境での起動とサーバー展開が同じ結果に見えてしまいます。
現時点でローカルH3について分かること
| 構成 | 公式に記載された結果 | 重要な注意点 |
|---|---|---|
| 公式の最適化ComfyUIパッケージ | モデル全体の占有量は42.5GB、動的オフロードでRTX 3060上でも起動可能 | 起動は速度ベンチマークではない |
| 公式SGLang例 | 4基のGPUを使った完全な展開 | サーバー向けであり、一般向け単一GPUの手順ではない |
ComfyUIの公式H3ガイドは、ネイティブ16:9キャンバスを1344×768に設定し、枝刈りしたINT8ウェイト、NVFP4テキストエンコーダー、個別の動画・音声VAE、オプションのTurbo LoRAをまとめています。[1] 公開された最適化では、フル精度時の占有量が123.6GBから42.5GBに減りました。オフロードは一部のコンポーネントをシステムメモリへ移して小容量GPUでも起動できるようにしますが、コンポーネント自体が不要になるわけではありません。
したがって、VRAM容量だけではローカルワークフローが実用的か判断できません。解像度、動画の長さ、実行時間、オフロード量を同じテスト結果に含める必要があります。
公式文書が示すローカルハードウェア情報
ここで引用する公式資料が示す具体的な展開方法は、動的オフロードを使う最適化ComfyUIワークフローと、マルチGPUのSGLang例の2つです。8GB、12GB、24GBの一般向けシステムを直接比較できる性能表は公開されていません。
ローカル実行結果を購入判断に使う前に、次の3点を確認してください。
- 正確なワークフローをメモリ不足エラーなしで読み込めるか。
- 生成される解像度と長さ、1回の試行にかかる時間はどれくらいか。
- 必要な出力はネイティブのローカルワークフローだけで作れるのか、それとも公式のホスト型コンテキストサービスや再生成サービスを使うのか。
MiniMaxのモデルカードも、ネイティブのローカルワークフローと完全な2K経路を区別しています。公開されている2Kワークフローは、ローカル展開と公式のContext-IRまたは再生成APIを組み合わせます。[2] したがって、ローカル768pとホスト型2Kは異なる出力製品であり、同じ作業に対する2種類の価格ではありません。
MiniMax H3 API コスト
2026 年 8 月 23 日に確認された価格:
| ホスト型ルート | 1 秒あたり | 5 秒 | 15 秒 |
|---|---|---|---|
| MiniMax 直接、768P | $0.080 | $0.400 | $1.200 |
| reAPI、768P | $0.074 | $0.370 | $1.110 |
| MiniMax 直接、2K | $0.130 | $0.650 | $1.950 |
| reAPI、2K | $0.119 | $0.595 | $1.785 |
MiniMax の公式料金シートは出力期間で課金します。入力ビデオ期間も選択された解像度で課金され、最初の 5 つの参照画像は無料、後の画像は料金を追加、オーディオ参照は無料です。[3]
reAPI MiniMax H3 モデルページは、個別の 768P および 2K レートを公開しています。[4]これらは日付けられた数字であり、永続的な約束ではありません。予算のため、ライブ ページを使用してください。
ハードウェアの採算分岐点は試行回数で測定される
H3 に $500 のハードウェア アップグレードが必要だと仮定します。最初に電気と設定時間は無視してください。
- 15 秒の 768P API クリップが $1.11 の場合、$500 は約 450 回の試行を購入します。
- 15 秒の 2K クリップが $1.785 の場合、約 280 回の試行を購入します。
- $1,000 のマシン予算は、768P では約 900 回の試行または 2K では約 560 回の試行に数字を移動します。
正しい単位は配信されたビデオではなく、試行です。1 つのアクセプトショットが 5 つの生成を必要とする場合、450 回の試行は 90 個の完成したショットになる可能性があります。ローカル生成は、拒否されたドラフトがワークロードを支配するときに最も利益を得ます。
算術は GPU が既にデスクに置かれている場合にも変わります。その購入コストは埋もれており、ローカル H3 は無制限の低解像度イテレーション、オフラインの参照資料、カスタム ノード、および完全なワークフロー制御に対してすぐに魅力的になります。
API アクセスは、ボリュームが不規則である場合、2K 配信物が必要である場合、複数のジョブがワークステーションを占有せずに実行する必要がある場合、またはチームがメモリ設定を調整するのに週末を費やすよりも、プロンプトをテストするのに $0.37 を費やす方が良い場合、そのコストを獲得します。
ライセンスを購入する前に確認してください
MiniMax H3 はオープンウェイト(Open-Weight)であり、Apache または MIT ライセンスではありません。現在のコミュニティ ライセンスは米国、欧州連合、英国、韓国を適用可能地域から除外し、そこのユーザーに別途の書面による認可を取得するよう指示しています。[5]
公開ダウンロードとデプロイメントの許可は別個の問題です。ライセンスには商用収益と帰属条件も含まれています。MiniMax H3 ライセンス ガイドでは、法的助言を提供しようとせずに条項を説明しています。
この区別は、チームがウェイトを直接取得および操作するためのセルフホスティングの場合に最も重要です。ホスト型 API は別の契約ルートであり、そのサービス契約条件に基づいて評価する必要があります。
よくある質問
MiniMax H3 は 8GB VRAM で実行できますか?
ここで引用する公式資料は、8GB構成での結果を示していません。ComfyUIの公式ガイドは動的オフロードによるRTX 3060での起動を記載していますが、8GB構成の性能を示すものではありません。
H3 には 12GB VRAM で十分ですか?
ここで引用する公式情報だけでは、すべての12GB構成が適しているとは言えません。示されているのは特定の最適化・オフロード経路であり、12GB全般の性能保証ではありません。
ローカル H3 は無料ですか?
生成あたりの API 請求はありませんが、ハードウェア、電力、ストレージ、セットアップ時間、失敗したローカル試行にはまだコストがあります。コミュニティ ライセンスは、意図されたデプロイメントが許可されているかどうかも決定できます。
API がローカル H3 より安いのはいつですか?
$500 の新しいハードウェア費用の場合、現在の採算分岐点は、電気とセットアップ時間の前に、reAPI で約 450 の 15 秒間の 768P 試行または約 280 の 15 秒間の 2K 試行です。
ローカル H3 はホスト型 API と同じ 2K 出力を生成しますか?
基本的なネイティブ ComfyUI ワークフローを通じてではありません。MiniMax は完全な 2K ワークフローをローカル デプロイメントと公式コンテキストまたはリジェネレーション サービスの組み合わせとして説明しています。
参考文献
- ComfyUI. MiniMax H3 公式チュートリアル。 2026 年 8 月 23 日に取得。docs.comfy.org
- MiniMaxAI. MiniMax H3 モデル カードおよびデプロイ例。 2026 年 8 月 23 日に取得。huggingface.co
- MiniMax API. 従量課金料金。 2026 年 8 月 23 日に取得。platform.minimax.io
- reAPI. MiniMax H3 モデル ページおよびライブ料金。 2026 年 8 月 23 日に取得。reapi.ai
- MiniMaxAI. MiniMax H3 コミュニティ ライセンス。 2026 年 8 月 23 日に取得。huggingface.co
他の記事

Wan 3.0はオープンソース?重みとAPI、ローカル実行の全て
Wan 3.0はAPIで利用可能ですが、公開重みはありません(2026年8月時点)。利用可能な内容と、Wan 2.2がローカルの選択肢として機能する場合を解説します。


Dreamina Seedance 2.5ユーザーガイド:30秒と長尺動画モード
Dreamina Seedance 2.5の実践ガイド。30秒生成、動画延長、長尺動画、タイムスタンプ、参照素材、編集、音声整理、絵コンテを例付きで解説します。


ChatGPT を使うのに AI らしさを避ける方法
ChatGPT を使いながら AI らしくない文章を書く。本当の主張、根拠、制限付きドラフト、そして慎重な編集で、実際に読まれる出版可能な文章を作る方法。
