
MiniMax H3 Max vs H3: velocidad, controles y rutas de API
Compara MiniMax H3 Max vs H3: velocidad, resolución, referencias de entrada, ruta de API, pesos públicos y caso de uso óptimo de cada modelo.
Elige MiniMax H3 Max cuando la velocidad importa más que salida de 768P y tu solicitud es text-to-video o image-to-video con fotograma inicial o final. Elige MiniMax H3 cuando necesites salida de 2K, referencias mixtas de imagen/vídeo/audio, o pesos descargables. H3 Max no es una mejora uniforme sobre H3. Es una variante post-entrenada de MiniMax H3 por parte de fal Research, emparejada con un stack de inferencia optimizado para velocidad.[1]
Hay una condición más: importa la ruta de API. La API directa de MiniMax y la ruta actual de reAPI exponen un contrato H3 Max más limitado que los propios endpoints alojados de fal. Una característica que se ve en fal no se puede copiar a un payload de MiniMax o reAPI y esperar que funcione.
Respuesta rápida
- Elige H3 Max para text-to-video rápido de 480P/768P o trabajos por fotograma inicial/final; elige H3 para salida de 2K o referencias más amplias de MiniMax.[3]
- H3 Max es una rama post-entrenada de fal de H3, no un toggle de velocidad en el modelo base.[1]
- La capacidad depende del endpoint: fal expone una ruta de referencia H3 Max, mientras que MiniMax directo y reAPI no.[4][7]
- H3 base tiene pesos públicos; las páginas de primera parte citadas no proporcionan un checkpoint descargable separado de H3 Max al 7 de septiembre de 2026.
MiniMax H3 Max es una rama de H3, no H3 con una configuración más alta
Los nombres invitan a un modelo mental incorrecto. "Max" suena como el mismo producto con todos los controles al máximo. El historial de lanzamiento dice algo diferente.
MiniMax introdujo H3 como un modelo multimodal de propósito general que entiende texto, imágenes, vídeo y audio, y genera vídeo con sonido estéreo nativo. MiniMax luego publicó checkpoints base de H3 el 3 de agosto.[2][6] fal Research comenzó desde esos pesos, añadió datos de post-entrenamiento dirigidos a la adherencia al prompt y la calidad visual, y co-optimizó el modelo resultante con su sistema de inferencia. El producto de ese trabajo es H3 Max.[1]
Ese linaje explica el trade-off. H3 Max apunta a un punto diferente en la curva de velocidad y control; no hereda cada tier de entrega y modo de entrada en cada servicio. La base sigue siendo la opción más amplia en el contrato directo de MiniMax.
Usa estos nombres con precisión en trabajo técnico:
| Nombre | Qué identifica | No inferir |
|---|---|---|
| MiniMax H3 | El modelo H3 base de MiniMax y checkpoints base públicos | Que cada ruta H3 alojada tiene campos idénticos |
| H3 Max de fal | La variante H3 post-entrenada de fal Research y trabajo de serving optimizado | Que "Max" añade 2K u otro control de H3 |
MiniMax-H3-Max | Valor de modelo en API V2 directa de MiniMax | Que se aceptan campos específicos del endpoint de fal |
minimax-h3-max | ID de modelo público en reAPI | Que acepta arrays de referencias base H3 |
Especificaciones de MiniMax H3 Max vs MiniMax H3 por ruta
La comparación más segura comienza con una superficie, no un nombre de marca. La tabla abajo separa los contratos vigentes el 7 de septiembre de 2026.
| Capacidad | MiniMax directo: H3 | MiniMax directo: H3 Max | reAPI: H3 Max | fal: H3 Max |
|---|---|---|---|---|
| Text-to-video | Sí | Sí | Sí | Sí |
| Fotograma inicial | Sí | Sí | Sí | Sí |
| Fotograma final | Sí | Sí | Sí | Sí |
| Fotograma inicial + final | Sí | Sí | Sí | Sí |
| Referencia mixta a vídeo | Sí | No | No | Endpoint separado |
| Resolución de salida | 768P, 2K | 480P, 768P | 480P, 768P | 480P, 768P |
| Duración | 4–15 segundos | 5–15 segundos | 5–15 segundos | 5–15 segundos |
| Pesos de modelo público | Checkpoints base publicados | Sin checkpoint separado verificado | Sin checkpoint separado verificado | Sin checkpoint separado verificado |
La documentación V2 propia de MiniMax es explícita sobre la división central: H3 Max directo no soporta imágenes de referencia, vídeo de referencia o audio de referencia, y no soporta 2K. Su modo image-to-video puede tomar un fotograma inicial, un fotograma final, o ambos.[3] El schema de solicitud local de reAPI refleja esos límites y rechaza campos extra en lugar de ignorarlos silenciosamente.
La ruta de referencia H3 Max de fal es real, pero pertenece a la última columna. Su forma de entrada actual expone slots de imagen de referencia, vídeo y audio.[4] Porque la cobertura de endpoints puede cambiar después del lanzamiento, fija el endpoint y revisa la fecha siempre que esta capacidad afecte una decisión de producto.
La resolución es el camino más rápido para decidir
Si el entregable debe venir directamente del generador por encima de 768P, MiniMax H3 Max es eliminado por su contrato actual. MiniMax H3 directo y la ruta MiniMax H3 en reAPI ambos exponen un tier de 2K. Un upscale posterior es posible en un flujo de trabajo separado, pero no es lo mismo que pedir a H3 Max una opción 2K nativa y documentada.
Si el entregable es 480P o 768P, la resolución ya no resuelve la cuestión. El tiempo de respuesta, referencias, disponibilidad de ruta y tasa de aceptación toman el control.
Material de referencia es la segunda puerta de decisión
Un fotograma inicial fija dónde comienza una toma. Un fotograma final fija dónde aterriza. Ninguno es equivalente a un pack de referencias.
Usa el modo de referencia base H3 cuando la toma debe combinar trabajos como:
- un retrato para identidad del sujeto;
- un vídeo corto para movimiento o lenguaje de cámara;
- un clip de audio para voz o dirección de sonido;
- imágenes adicionales para un prop, vestuario o entorno.
En MiniMax directo y reAPI, enviar esos campos de referencia del modelo base a H3 Max es una solicitud inválida. Si la ruta reference-to-video de fal es la ruta que intiendes comprar y mantener, evalúa su propio schema en lugar de eso. No diseñes un payload portátil alrededor del proveedor más permisivo.
Lo que la afirmación de velocidad de H3 Max hace—y no hace—establecer
fal reportó que H3 Max generó un vídeo de cinco segundos en menos de tres segundos de tiempo real en su stack optimizado, con aproximadamente 35 veces el throughput del endpoint oficial H3 en la comparación de fal.[1] Esa es evidencia significativa sobre el lanzamiento de fal e infraestructura. No es una garantía universal de nivel de servicio.
MiniMax Design da cifras diferentes para usuarios finales: aproximadamente 15 segundos para un clip de cinco segundos y 40 segundos para un clip de 15 segundos, con variación por configuración y condiciones de servicio.[5] Esas cifras no contradicen que el modelo sea rápido. Miden una superficie diferente, potencialmente incluyendo trabajo fuera del kernel de inferencia optimizado.
La espera de un usuario puede incluir:
latencia end-to-end =
carga + admisión + cola + procesamiento de prompt + inferencia
+ procesamiento de salida + almacenamiento + retraso de polling + descargaSolo una prueba coincidente en la ruta que enviarás puede responder "¿qué tan rápido será para nosotros?" La guía de velocidad real de H3 Max dedica cómo medir ese intervalo completo sin reetiquetan un benchmark de vendor como un resultado independiente.
Las afirmaciones de calidad necesitan una prueba de aceptación coincidente
fal dice que su evaluación interna de preferencia humana clasificó H3 Max por encima de la base en preferencia general, comprensión de prompt y estética. El mismo anuncio explica que fal seleccionó checkpoints contra sus propias evaluaciones head-to-head.[1] Ese es un resultado útil de vendor, no prueba de que H3 Max gane cada prompt o preserve cada capacidad H3.
Ejecuta la decisión de modelo contra los fallos que tu proyecto no puede tolerar. Un set de prueba compacto debe incluir más que metraje escénico:
- Acción temporizada: tres beats visibles en un orden fijo.
- Movimiento de cámara más sujeto: movimiento de ambos sin colapso de geometría.
- Dos hablantes: voces distintas, turnos correctos de hablante, y caras estables.
- Interpolación inicial/final: composición idéntica con un camino plausible entre endpoints.
- Pequeños detalles fijos: geometría de producto, marcas de prenda, o un prop que no debe cambiar.
- Tu ratio de entrega real: incluye apaisado y vertical si ambos se envían.
Mantén texto de prompt, duración, resolución y assets de fuente idénticos. Aleatoriza qué salida ven primero los revisores, oculta la etiqueta de modelo, y escribe las condiciones de aprobación antes de generar. Luego registra dos números diferentes:
tasa de aceptación = clips aceptados / clips completados
clips aceptados por hora =
clips completados por hora × tasa de aceptaciónEl segundo número puede revertir un resultado de velocidad superficial. Una ruta rápida que necesita muchos reintentos puede entregar menos clips útiles que una más lenta. Conversamente, una diferencia de calidad modesta puede ser irrelevante cuando H3 Max permite a un editor probar varias revisiones de prompt concretas dentro de la misma ventana de revisión.
El cambio de solicitud reAPI con la elección de modelo
Para text-to-video H3 Max en reAPI, envía su ID de modelo público exacto, una relación de aspecto concreta, y uno de sus dos valores de resolución:
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer $REAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3-max",
"prompt": "Five seconds, one continuous shot. A red paper boat moves through a shallow rain gutter as the camera tracks beside it. Natural rain and street ambience, no dialogue.",
"aspect_ratio": "16:9",
"duration": 5,
"resolution": "480P"
}'El payload del modelo base se vuelve materialmente diferente cuando las referencias son la razón para elegir H3:
{
"model": "minimax-h3",
"prompt": "Image 1 defines the character. Follow the pacing of Video 1 and use Audio 1 for the voice; keep the speaker identity stable.",
"reference_image_urls": ["https://assets.example.com/character.jpg"],
"reference_video_urls": ["https://assets.example.com/motion.mp4"],
"reference_audio_urls": ["https://assets.example.com/voice.wav"],
"duration": 6,
"resolution": "768P"
}Ambos trabajos son asincronos. Guarda el id devuelto, luego poll la API de Tareas hasta que el estado sea completed o failed. Cambiar solo la cadena de modelo mientras dejas campos de referencia no soportados en su lugar no es una migración válida.
Elige H3 Max o H3 por la restricción que no puedes mover
| Tu requisito innegociable | Mejor punto de inicio | Razón |
|---|---|---|
| Iteración rápida de prompt 480P/768P | H3 Max | La velocidad es el propósito de la ruta post-entrenada |
| Salida 2K directa | H3 | H3 Max actualmente se detiene a 768P |
| Referencias mixtas en MiniMax directo o reAPI | H3 | Esos contratos H3 Max no exponen R2V |
| H3 Max reference-to-video específicamente en fal | H3 Max en fal | fal mantiene un endpoint R2V separado en vivo |
| Pesos descargables para experimentos locales | H3 | Los checkpoints base están publicados |
| Salida de cuatro segundos | H3 | H3 Max comienza a cinco segundos |
| Toma first/last-frame a 768P | Prueba ambos | Ambos pueden expresar la toma; la aceptación y latencia de ruta deciden |
Por eso un ganador abstracto no es útil. El mejor modelo es el que satisface la restricción fija, luego produce los clips más aceptados dentro del tiempo y presupuesto restantes.
FAQ
¿Es MiniMax H3 Max mejor que MiniMax H3?
No para cada trabajo. H3 Max es el punto de inicio más fuerte cuando el turnaround rápido de 480P/768P es la prioridad. H3 sigue siendo la opción para 2K directo, clips de cuatro segundos, referencias de entrada más amplias en MiniMax directo o reAPI, y pesos base descargables.
¿Quién hizo MiniMax H3 Max?
fal Research desarrolló H3 Max mediante post-entrenamiento de MiniMax H3 y emparejándolo con el trabajo de inferencia optimizado de fal. MiniMax hizo el modelo H3 base y publicó sus pesos base.[1][6]
¿Soporta MiniMax H3 Max reference-to-video?
Depende de la ruta. La API H3 Max directa de MiniMax y la ruta H3 Max actual de reAPI no. fal tiene un endpoint reference-to-video H3 Max separado. Nombra el proveedor y endpoint siempre que declares esta capacidad.
¿Puede MiniMax H3 Max generar vídeo 2K?
No, no a través de los contratos MiniMax directo o reAPI actuales. Exponen 480P y 768P para H3 Max. H3 base expone 768P y 2K en esas rutas.[3]
¿Es H3 Max open source porque MiniMax H3 lo es?
No. "Construido desde pesos abiertos" no hace públicos los pesos derivados. Los checkpoints H3 base son descargables; sin checkpoint H3 Max separado y verificado aparece en los materiales de lanzamiento de primera parte citados aquí al 7 de septiembre de 2026. Ver la guía de estado open-source de H3 Max para la lista de control de evidencia.
¿H3 Max siempre devuelve un vídeo de cinco segundos en tres segundos?
No. La cifra sub-tres-segundo es el resultado reportado de fal en su stack optimizado, no una promesa para cada ruta, solicitud, cola o descarga. MiniMax Design publica un tiempo aproximado diferente para usuario final.
La regla de decisión más confiable más corta
Comienza con MiniMax H3 Max para text-to-video rápido de 480P o 768P y tomas impulsadas por fotograma. Muévete a MiniMax H3 cuando el brief requiera 2K, un corte de cuatro segundos, referencias mixtas en MiniMax directo o reAPI, o pesos base públicos. Si el endpoint de referencia H3 Max de fal es parte del plan, registra esa ruta explícitamente en lugar de describir reference-to-video como una característica universal de H3 Max.
Esa una disciplina—modelo más proveedor más endpoint—evita que la mayoría de comparaciones H3 Max versus H3 se vuelvan obsoletas o técnicamente incorrectas.
Referencias
- fal. Introducing H3 Max by fal. Publicado el 26 de agosto de 2026. fal.ai
- MiniMax. MiniMax H3: An Open Model Breaking the Boundaries Between Tasks and Modalities. Publicado el 31 de julio de 2026. minimax.io
- MiniMax API. Create Video Generation Task V2. Recuperado el 7 de septiembre de 2026. platform.minimax.io
- fal. H3 Max Reference to Video endpoint. Recuperado el 7 de septiembre de 2026. fal.ai
- MiniMax Design. MiniMax H3 Max—Fast AI Video Generator. Recuperado el 7 de septiembre de 2026. design.minimax.io
- MiniMax. Open General Intelligence: MiniMax H3 Is Now Open Source. Publicado el 3 de agosto de 2026. minimax.io
- reAPI. MiniMax H3 Max model page and request controls. Recuperado el 7 de septiembre de 2026. reapi.ai
Lectura adicional
Autor

Categorías
Más publicaciones

Seedance Face Detected: errores por persona real explicados
Resuelve errores de face detected en Seedance consultando campos soportados, reglas de media, revisión automatizada y estado de reembolso completo.


Usar ChatGPT sin sonar como IA: guía de redacción
Usa ChatGPT sin prosa genérica de IA. Convierte una tesis real, evidencia, redacción limitada y edición humana cuidadosa en escritura publicable.


Transferencia de fotograma clave: Seedream a Seedance
Seedream fija composición con imagen barata, Seedance genera movimiento desde ese fotograma aprobado. Qué responsabilidades tiene cada fase y dónde falla.
