
MiniMax H3 локально vs API: VRAM, цена и лицензия
Что официальные документы MiniMax и ComfyUI подтверждают о локальном оборудовании H3? Сравним документированный процесс с ценами облачных API 768P и 2K.
Запускайте MiniMax H3 локально, если официальный оптимизированный процесс подходит вашему оборудованию и нужны многократные итерации или приватные входные данные; используйте API для редких готовых клипов, облачного вывода 2K, параллельной обработки или работы без настройки. Официальное руководство ComfyUI говорит, что динамическая выгрузка позволяет запустить процесс на RTX 3060, однако сам запуск не является тестом скорости и не доказывает, что разные объёмы VRAM дают эквивалентный результат.[1]
К фразе «работает локально» нужно добавить три числа: разрешение, длительность и время выполнения. Без них запуск с малым объёмом памяти и серверное развёртывание выглядят одинаково.
Что сейчас означает локальный H3
| Конфигурация | Официально документированный результат | Важное уточнение |
|---|---|---|
| Официальный оптимизированный пакет ComfyUI | Общий объём модели 42.5GB; динамическая выгрузка позволяет запустить на RTX 3060 | Запуск не является тестом скорости |
| Официальный пример SGLang | Полное развёртывание на четырёх GPU | Серверный маршрут, а не рецепт для одной потребительской GPU |
Официальное руководство H3 в ComfyUI задаёт родной холст 16:9 размером 1344×768 и включает сокращённые веса INT8, текстовый кодировщик NVFP4, отдельные VAE для видео и аудио и необязательные Turbo LoRA.[1] Опубликованная оптимизация уменьшила объём полной точности с 123.6GB до 42.5GB. Выгрузка позволяет небольшой карте запустить процесс, перемещая компоненты через системную память, но не устраняет эти компоненты.
Поэтому одного объёма VRAM недостаточно, чтобы оценить полезность локального процесса. Разрешение, длительность, время выполнения и объём выгрузки должны находиться в одном результате теста.
Что официальные документы подтверждают о локальном оборудовании
Процитированные официальные материалы подтверждают два конкретных пути развёртывания: оптимизированный процесс ComfyUI с динамической выгрузкой и пример SGLang с несколькими GPU. Они не публикуют сопоставимую таблицу производительности для потребительских систем с 8GB, 12GB и 24GB.
Прежде чем считать любой локальный результат рекомендацией к покупке, задайте три прямых вопроса:
- Загружается ли точный процесс без ошибки нехватки памяти?
- Какое разрешение и длительность он создаёт и сколько занимает одна попытка?
- Требуемый результат использует только родной локальный процесс или официальный облачный сервис контекста либо регенерации?
Карточка модели MiniMax также отличает родной локальный процесс от полного пути 2K. Опубликованный процесс 2K сочетает локальное развёртывание с официальными API Context-IR или регенерации.[2] Поэтому локальный 768p и облачный 2K — разные продукты, а не две цены за одну и ту же задачу.
Цена API MiniMax H3
Цены проверены 23 августа 2026:
| Облачный маршрут | За секунду | 5 секунд | 15 секунд |
|---|---|---|---|
| MiniMax напрямую, 768P | $0.080 | $0.400 | $1.200 |
| reAPI, 768P | $0.074 | $0.370 | $1.110 |
| MiniMax напрямую, 2K | $0.130 | $0.650 | $1.950 |
| reAPI, 2K | $0.119 | $0.595 | $1.785 |
Официальная таблица цен MiniMax берёт плату по длительности результата. Длительность входного видео также тарифицируется с выбранным разрешением, первые пять референсных изображений бесплатны, позже добавляется плата, а аудио-референсы бесплатны.[3]
Страница модели reAPI MiniMax H3 опубликовывает отдельные тарифы 768P и 2K.[4] Это датированные числа, а не постоянные обещания; используйте живую страницу для бюджета.
Точка безубыточности оборудования измеряется в попытках
Предположим, H3 требует обновления оборудования за $500. Пока игнорируем электричество и время настройки.
- При $1.11 за 15-секундный клип 768P в API, $500 покупает примерно 450 попыток.
- При $1.785 за 15-секундный клип 2K, он покупает примерно 280 попыток.
- Бюджет машины в $1,000 переводит эти цифры в примерно 900 попыток на 768P или 560 на 2K.
Правильная единица измерения — попытки, а не доставленные видео. Если один удачный кадр требует пяти поколений, 450 попыток могут превратиться в 90 готовых клипов. Локальная генерация выигрывает больше всего, когда отклонённые черновики доминируют в нагрузке.
Арифметика меняется и тогда, когда GPU уже стоит на столе. Её стоимость покупки утоплена, и локальный H3 становится привлекательным быстро для неограниченной низкорезультативной итерации, оффлайн-материала, пользовательских узлов и полного контроля воркфлоу.
Доступ к API окупает свою стоимость, когда объём нерегулярен, требуется результат 2K, несколько работ должны выполняться без занятия рабочей станции или команда предпочитает потратить $0.37 на тестирование промпта, чем проводить выходные, настраивая память.
Проверьте лицензию до покупки GPU
MiniMax H3 имеет открытые веса, но не лицензирован Apache или MIT. Текущая лицензия сообщества исключает Соединённые Штаты, Европейский союз, Великобританию и Южную Корею из своей территории применения и направляет пользователей туда получать отдельное письменное разрешение.[5]
Публичная загрузка и разрешение на развёртывание — это отдельные вопросы. Лицензия также содержит условия коммерческого дохода и атрибуции. Наше руководство по лицензии MiniMax H3 объясняет пункты без попытки предоставить юридическую консультацию.
Это различие наиболее важно для самостоятельного хостинга, потому что команда непосредственно берёт и управляет весами. Облачный API — это другой договорной путь и должен быть оценён согласно его условиям обслуживания.
Часто задаваемые вопросы
Может ли MiniMax H3 работать на 8GB VRAM?
Процитированные официальные материалы не подтверждают результат для конфигурации 8GB. Официальное руководство ComfyUI описывает запуск на RTX 3060 с динамической выгрузкой, но не устанавливает производительность конфигурации 8GB.
Достаточно ли 12GB VRAM для H3?
Процитированных официальных данных недостаточно, чтобы признать подходящей любую конфигурацию 12GB. Они показывают конкретный оптимизированный путь с выгрузкой, а не общую гарантию производительности для 12GB.
Бесплатен ли локальный H3?
Нет счёта за генерацию через API, но оборудование, электроэнергия, хранилище, время настройки и неудачные локальные попытки имеют затраты. Лицензия сообщества также может определить, разрешено ли предполагаемое развёртывание.
Когда API дешевле, чем локальный H3?
Для новых расходов на оборудование $500, текущая точка безубыточности — примерно 450 попыток 768P в 15 секунд или 280 попыток 2K в 15 секунд на reAPI, до электричества и времени настройки.
Производит ли локальный H3 такой же результат 2K, как облачный API?
Нет, через базовый собственный воркфлоу ComfyUI. MiniMax описывает полный воркфлоу 2K как комбинацию локального развёртывания и официальных сервисов контекста или регенерации.
Ссылки
- ComfyUI. MiniMax H3 official tutorial. Retrieved August 23, 2026. docs.comfy.org
- MiniMaxAI. MiniMax H3 model card and deployment examples. Retrieved August 23, 2026. huggingface.co
- MiniMax API. Pay-as-you-go pricing. Retrieved August 23, 2026. platform.minimax.io
- reAPI. MiniMax H3 model page and live pricing. Retrieved August 23, 2026. reapi.ai
- MiniMaxAI. MiniMax H3 Community License. Retrieved August 23, 2026. huggingface.co
Автор

Категории
Ещё статьи

Статус Seedance 2.5: API, цены и ограничения
Seedance 2.5 уже доступен. Модельный ID reAPI, цены 480p/720p, 30-секундный вывод, пределы референсов и тарификация исходного видео.


Дешевле ли Claude Fable 5.1? Расчёты кэширования и цены
Claude Fable 5.1 сохраняет ставки Fable 5 ($10/$50 млн), но кэш дешевеет до $0.25. Рассчитайте реальную стоимость и не путайте счета API с подписками.


Кто получит доступ к GPT-6 Astra? ChatGPT, Work, Codex и API
Узнай, кто может использовать GPT-6 Astra в ChatGPT, Work, Codex и API на 7 сентября 2026, плюс полный список проверки причин блокировки доступа.
