
DeepSeek
DeepSeek V4
Desde $0.140 por 1M tokens
MiniMax M3 es un modelo de pesos abiertos que combina benchmarks de programación y agénticos de frontera con una ventana de contexto de 1M tokens y entrada multimodal nativa. MiniMax M3 razona antes de responder, invoca herramientas en ejecuciones de largo horizonte y lee imágenes y vídeo en la misma llamada — expuesto en api.reapi.ai como un endpoint compatible con OpenAI listo para usar. Pago por uso en USD a una fracción de las tarifas de frontera de código cerrado.
minimax/minimax-m3Los modelos de chat se ejecutan en la pasarela api.reapi.ai, que tiene su propia consola y su propia clave. Abre la consola para ejecutar MiniMax M3 a través de la interfaz Chat Completions compatible con OpenAI.
MiniMax M3 es el modelo frontera de pesos abiertos de MiniMax para programación y flujos agénticos, disponible en reAPI a través de un endpoint de chat completions compatible con OpenAI. Combina una ventana de contexto de 1M de tokens con hasta 512K tokens de salida, un razonamiento nativo que intercala pensamiento y llamadas a herramientas a lo largo de ejecuciones largas, y entrada multimodal nativa con imágenes y vídeo. Los tokens de entrada y de salida se facturan por separado por millón de tokens, y la entrada en caché se cobra a una tarifa más baja que la entrada nueva.
Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

La programación agéntica es el titular de MiniMax M3. MiniMax reporta resultados de nivel de frontera en benchmarks de ingeniería de software — 59.0% en SWE-Bench Pro y 66.0% en Terminal-Bench 2.1 — situando a MiniMax M3 al nivel de los mejores modelos de programación de código cerrado, manteniéndose de pesos abiertos. Apunta un agente de programación a MiniMax M3 y define el alcance de la tarea, invoca herramientas, razona a lo largo de trabajo de múltiples pasos y se autocorrige en una ejecución larga, todo en una sola sesión.
Leer la documentación de la API
MiniMax M3 usa por defecto una ventana de contexto de 1M tokens — suficiente para cargar un repositorio mediano completo, un paquete de investigación extenso o una traza de agente de varios turnos en una sola llamada. MiniMax Sparse Attention mantiene eficiente la inferencia de contexto largo, por lo que las cargas de trabajo de MiniMax M3 como revisión de arquitectura, auditorías de dependencias y planificación de migraciones rara vez necesitan fragmentación. Los prefijos de prompt estables alcanzan la baja tarifa de lectura de caché en cada repetición.

MiniMax M3 es multimodal desde la base: envía imágenes y vídeo junto al texto en la misma llamada de Chat Completions — capturas de pantalla, diagramas, escaneos de documentos y clips — y el modelo razona sobre todo ello. Combinado con llamadas a funciones fiables y salida JSON, MiniMax M3 impulsa agentes de navegador, pipelines de documentos y flujos de trabajo con herramientas que mezclan visión, recuperación y código.
Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.
Una generación en el nivel más barato (1M tokens).
| Modelo | Categoría | Precio |
|---|---|---|
| Precio por token | Entrada | $0.6 1M tokens |
| Salida | $2.4 1M tokens | |
| Lectura de caché | $0.12 1M tokens |
MiniMax M3 habla OpenAI Chat Completions al pie de la letra. Migrar una integración OpenAI existente a MiniMax M3 es un cambio de base URL, una API key y una cadena de modelo — `minimax/minimax-m3` — no una reescritura de plataforma. El mismo array `messages`, el mismo formato de streaming, la misma forma de llamada a herramientas.
MiniMax M3 es de pesos abiertos y tiene un precio acorde. Registra benchmarks de programación y agénticos de frontera mientras cuesta una fracción de los modelos de código cerrado por token — y el almacenamiento en caché de prompts vuelve a bajar el precio en contexto repetido. Ejecuta trabajo agéntico premium sin facturas premium por token.
Una única clave de api.reapi.ai desbloquea MiniMax M3 junto a GPT-5.5, Claude Opus 4.8, DeepSeek V4, Gemini y todos los demás modelos de chat de frontera de la plataforma. Compara proveedores, añade fallbacks y enruta el tráfico por llamada con un cambio de configuración en lugar de un proyecto de integración.
MiniMax M3 y DeepSeek V4 son ambos modelos de pesos abiertos y precio de valor con una ventana de contexto de 1M tokens, razonamiento y uso de herramientas. Así es como se posiciona MiniMax M3 frente a DeepSeek V4 en las dimensiones que importan para el trabajo agéntico y de programación.
La comparación refleja el comportamiento documentado públicamente en las notas de lanzamiento de M3 de MiniMax y la documentación de V4 de DeepSeek en el momento de escribir esto. Las cifras de benchmarks son reportadas por el proveedor. El comportamiento del modelo y los precios pueden cambiar; consulta la tarjeta de precios de arriba y la documentación de la API para los valores actuales.
Regístrate en api.reapi.ai, abre la consola, genera una API key en API Keys y recarga tokens en Top Up. El espacio de trabajo de chat está separado del gateway de imagen/vídeo de reapi.ai — las claves no se cruzan.
AbrirPOST https://api.reapi.ai/v1/chat/completions con `model` ajustado a `minimax/minimax-m3`, tu array `messages` y `max_tokens`. El endpoint de MiniMax M3 es compatible con OpenAI, incluidas las respuestas en streaming, así que la mayoría de los SDK funcionan solo con un cambio de base URL.
AbrirMiniMax M3 piensa de forma adaptativa — razona cuando una tarea es difícil y responde directamente cuando no lo es. Reutiliza prompts de sistema y esquemas de herramientas estables entre llamadas para alcanzar la baja tarifa de lectura de caché, y establece `max_tokens` lo bastante alto para que quepa la cadena de razonamiento en trabajo con mucho razonamiento.
Abrircurl https://api.reapi.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax/minimax-m3",
"group": "default",
"messages": [
{ "role": "user", "content": "Hello" }
],
"stream": true,
"max_tokens": 4096,
"temperature": 1.0
}'Rechazado de forma síncrona con el campo problemático indicado. Revisa enums, rangos y campos de URL — no se cobra nada.
401 significa clave Bearer ausente o inválida; 402, que la reserva supera tu saldo. Gestiona claves y créditos en la consola.
El material de referencia y las salidas pasan una moderación automática. Las tareas rechazadas fallan con un error claro y reembolso completo.
Una tarea que llega a estado fallido nunca se cobra: la reserva se reembolsa automáticamente. Guarda el ID y reintenta.
Dudas comunes sobre este modelo.
Explora más modelos de la misma categoría.

DeepSeek
Desde $0.140 por 1M tokens

Z.AI
Desde $0.900 por 1M tokens

OpenAI
Desde $0.800 por 1M tokens

OpenAI
Desde $1.00 por 1M tokens
Pruébalo en el playground o consigue una API key para integrarlo ahora.