Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
MiniMax H3 локально vs API: VRAM, цена и лицензия
2026/08/23

MiniMax H3 локально vs API: VRAM, цена и лицензия

Что официальные документы MiniMax и ComfyUI подтверждают о локальном оборудовании H3? Сравним документированный процесс с ценами облачных API 768P и 2K.

Запускайте MiniMax H3 локально, если официальный оптимизированный процесс подходит вашему оборудованию и нужны многократные итерации или приватные входные данные; используйте API для редких готовых клипов, облачного вывода 2K, параллельной обработки или работы без настройки. Официальное руководство ComfyUI говорит, что динамическая выгрузка позволяет запустить процесс на RTX 3060, однако сам запуск не является тестом скорости и не доказывает, что разные объёмы VRAM дают эквивалентный результат.[1]

К фразе «работает локально» нужно добавить три числа: разрешение, длительность и время выполнения. Без них запуск с малым объёмом памяти и серверное развёртывание выглядят одинаково.

Что сейчас означает локальный H3

КонфигурацияОфициально документированный результатВажное уточнение
Официальный оптимизированный пакет ComfyUIОбщий объём модели 42.5GB; динамическая выгрузка позволяет запустить на RTX 3060Запуск не является тестом скорости
Официальный пример SGLangПолное развёртывание на четырёх GPUСерверный маршрут, а не рецепт для одной потребительской GPU

Официальное руководство H3 в ComfyUI задаёт родной холст 16:9 размером 1344×768 и включает сокращённые веса INT8, текстовый кодировщик NVFP4, отдельные VAE для видео и аудио и необязательные Turbo LoRA.[1] Опубликованная оптимизация уменьшила объём полной точности с 123.6GB до 42.5GB. Выгрузка позволяет небольшой карте запустить процесс, перемещая компоненты через системную память, но не устраняет эти компоненты.

Поэтому одного объёма VRAM недостаточно, чтобы оценить полезность локального процесса. Разрешение, длительность, время выполнения и объём выгрузки должны находиться в одном результате теста.

Что официальные документы подтверждают о локальном оборудовании

Процитированные официальные материалы подтверждают два конкретных пути развёртывания: оптимизированный процесс ComfyUI с динамической выгрузкой и пример SGLang с несколькими GPU. Они не публикуют сопоставимую таблицу производительности для потребительских систем с 8GB, 12GB и 24GB.

Прежде чем считать любой локальный результат рекомендацией к покупке, задайте три прямых вопроса:

  • Загружается ли точный процесс без ошибки нехватки памяти?
  • Какое разрешение и длительность он создаёт и сколько занимает одна попытка?
  • Требуемый результат использует только родной локальный процесс или официальный облачный сервис контекста либо регенерации?

Карточка модели MiniMax также отличает родной локальный процесс от полного пути 2K. Опубликованный процесс 2K сочетает локальное развёртывание с официальными API Context-IR или регенерации.[2] Поэтому локальный 768p и облачный 2K — разные продукты, а не две цены за одну и ту же задачу.

Цена API MiniMax H3

Цены проверены 23 августа 2026:

Облачный маршрутЗа секунду5 секунд15 секунд
MiniMax напрямую, 768P$0.080$0.400$1.200
reAPI, 768P$0.074$0.370$1.110
MiniMax напрямую, 2K$0.130$0.650$1.950
reAPI, 2K$0.119$0.595$1.785

Официальная таблица цен MiniMax берёт плату по длительности результата. Длительность входного видео также тарифицируется с выбранным разрешением, первые пять референсных изображений бесплатны, позже добавляется плата, а аудио-референсы бесплатны.[3]

Страница модели reAPI MiniMax H3 опубликовывает отдельные тарифы 768P и 2K.[4] Это датированные числа, а не постоянные обещания; используйте живую страницу для бюджета.

Точка безубыточности оборудования измеряется в попытках

Предположим, H3 требует обновления оборудования за $500. Пока игнорируем электричество и время настройки.

  • При $1.11 за 15-секундный клип 768P в API, $500 покупает примерно 450 попыток.
  • При $1.785 за 15-секундный клип 2K, он покупает примерно 280 попыток.
  • Бюджет машины в $1,000 переводит эти цифры в примерно 900 попыток на 768P или 560 на 2K.

Правильная единица измерения — попытки, а не доставленные видео. Если один удачный кадр требует пяти поколений, 450 попыток могут превратиться в 90 готовых клипов. Локальная генерация выигрывает больше всего, когда отклонённые черновики доминируют в нагрузке.

Арифметика меняется и тогда, когда GPU уже стоит на столе. Её стоимость покупки утоплена, и локальный H3 становится привлекательным быстро для неограниченной низкорезультативной итерации, оффлайн-материала, пользовательских узлов и полного контроля воркфлоу.

Доступ к API окупает свою стоимость, когда объём нерегулярен, требуется результат 2K, несколько работ должны выполняться без занятия рабочей станции или команда предпочитает потратить $0.37 на тестирование промпта, чем проводить выходные, настраивая память.

Проверьте лицензию до покупки GPU

MiniMax H3 имеет открытые веса, но не лицензирован Apache или MIT. Текущая лицензия сообщества исключает Соединённые Штаты, Европейский союз, Великобританию и Южную Корею из своей территории применения и направляет пользователей туда получать отдельное письменное разрешение.[5]

Публичная загрузка и разрешение на развёртывание — это отдельные вопросы. Лицензия также содержит условия коммерческого дохода и атрибуции. Наше руководство по лицензии MiniMax H3 объясняет пункты без попытки предоставить юридическую консультацию.

Это различие наиболее важно для самостоятельного хостинга, потому что команда непосредственно берёт и управляет весами. Облачный API — это другой договорной путь и должен быть оценён согласно его условиям обслуживания.

Часто задаваемые вопросы

Может ли MiniMax H3 работать на 8GB VRAM?

Процитированные официальные материалы не подтверждают результат для конфигурации 8GB. Официальное руководство ComfyUI описывает запуск на RTX 3060 с динамической выгрузкой, но не устанавливает производительность конфигурации 8GB.

Достаточно ли 12GB VRAM для H3?

Процитированных официальных данных недостаточно, чтобы признать подходящей любую конфигурацию 12GB. Они показывают конкретный оптимизированный путь с выгрузкой, а не общую гарантию производительности для 12GB.

Бесплатен ли локальный H3?

Нет счёта за генерацию через API, но оборудование, электроэнергия, хранилище, время настройки и неудачные локальные попытки имеют затраты. Лицензия сообщества также может определить, разрешено ли предполагаемое развёртывание.

Когда API дешевле, чем локальный H3?

Для новых расходов на оборудование $500, текущая точка безубыточности — примерно 450 попыток 768P в 15 секунд или 280 попыток 2K в 15 секунд на reAPI, до электричества и времени настройки.

Производит ли локальный H3 такой же результат 2K, как облачный API?

Нет, через базовый собственный воркфлоу ComfyUI. MiniMax описывает полный воркфлоу 2K как комбинацию локального развёртывания и официальных сервисов контекста или регенерации.

Ссылки

  1. ComfyUI. MiniMax H3 official tutorial. Retrieved August 23, 2026. docs.comfy.org
  2. MiniMaxAI. MiniMax H3 model card and deployment examples. Retrieved August 23, 2026. huggingface.co
  3. MiniMax API. Pay-as-you-go pricing. Retrieved August 23, 2026. platform.minimax.io
  4. reAPI. MiniMax H3 model page and live pricing. Retrieved August 23, 2026. reapi.ai
  5. MiniMaxAI. MiniMax H3 Community License. Retrieved August 23, 2026. huggingface.co