Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 por segundo

Kimi K3 — contexto de 1M, insignia de pesos abiertos

Kimi K3 es el modelo insignia de Moonshot para programación de horizonte largo y trabajo de conocimiento de extremo a extremo. Kimi K3 lee una ventana de contexto de 1.048.576 tokens, razona siempre y ofrece un dial de esfuerzo de razonamiento de tres peldaños, de low a max. La visión nativa cubre imágenes y vídeo, los pesos son abiertos y en reAPI Kimi K3 se factura por debajo de la tarifa por token publicada por Moonshot, tanto en entrada como en salida.

Características
Flagship Moonshot · llamadas de herramientas · salida JSON
Ideal para
Trabajo de contexto largo zh / en, agentes
Entrada
Mensajes de chat (compatible con OpenAI)
Salida
Texto, streaming opcional
Kimi K3modelkimi-k3

Playground de Kimi K3

Los modelos de chat se ejecutan en la pasarela api.reapi.ai, que tiene su propia consola y su propia clave. Abre la consola para ejecutar Kimi K3 a través de la interfaz Chat Completions compatible con OpenAI.

¿Qué es la API de Kimi K3?

Kimi K3 es el modelo insignia de pesos abiertos de Moonshot AI para programación de largo recorrido y trabajo de conocimiento de principio a fin, disponible en reAPI a través de un endpoint de chat completions compatible con OpenAI. Tiene una ventana de contexto de 1.048.576 tokens y puede devolver esa ventana entera en una sola respuesta (el límite de salida por defecto es de 131.072 tokens), razona siempre con un esfuerzo configurable en low, high o max, y acepta imágenes y vídeo de forma nativa, además de llamadas a herramientas y salida con JSON Schema estricto. Los tokens de entrada y de salida se facturan por separado por millón de tokens, y la caché de contexto se activa automáticamente con prefijos repetidos.

Lo que puedes construir con este modelo

Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

Kimi K3 arreglando un defecto de maquetación a partir de una captura de la página rota

Programación de horizonte largo, con capturas en el bucle

Moonshot sitúa a Kimi K3 en la programación de horizonte largo y lo describe sacando adelante tareas de ingeniería con mínima supervisión humana: leyendo y modificando bases de código grandes y coordinando herramientas de terminal. Lo que separa a Kimi K3 de un modelo de código solo textual es que la visión es nativa y no un añadido: las capturas y el feedback visual son entradas, y Moonshot menciona expresamente desarrollo de videojuegos, ingeniería frontend y CAD. Eso cierra un bucle que un modelo solo textual no puede cerrar, porque el modelo puede mirar lo que acaba de construir y juzgar si la maquetación está realmente mal antes de volver a editar.

Leer la documentación de la API
Kimi K3 leyendo un gran conjunto de documentos y produciendo un entregable estructurado

Un millón de tokens de trabajo de conocimiento sin capa de fragmentación

La ventana de contexto de Kimi K3 es de 1.048.576 tokens, y la propia FAQ de Moonshot dice que la tarifa es plana, sin escalones según la longitud del contexto: llenar la ventana cuesta por token lo que cuesta cualquier otro token. Un conjunto de contratos, un dossier de investigación o un año de presentaciones va entero a Kimi K3, lo que elimina la capa de recuperación cuyo único cometido era esquivar un contexto pequeño. El trabajo repetido lo asume después la caché de contexto: en Kimi K3 es automática, sin id de caché, sin TTL y sin parámetros extra, así que un prefijo estable delante de una pregunta cambiante es el patrón con el que construir.

Kimi K3 ejecutando un bucle agéntico con herramientas cargadas a mitad de camino

Agentes obligados a llamar herramientas, no persuadidos de hacerlo

Con esta generación llegaron dos controles de llamada a herramientas. Una elección de herramienta requerida fuerza al menos una llamada en el turno, que es la forma de evitar que un agente responda de memoria cuando debía ir a consultar: los modelos K2 rechazan ese valor y Kimi K3 lo acepta. Y una herramienta puede introducirse a mitad de conversación poniendo su definición completa en un mensaje de sistema, de modo que un inventario grande de herramientas no tiene que declararse por adelantado en cada petición. Las salidas estructuradas y un JSON Schema mantienen parseable lo que Kimi K3 devuelve al final del bucle.

Precios

Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.

Coste de la primera prueba
$2.52,500 credits

Una generación en el nivel más barato (1M tokens).

Guía de presupuesto de pruebas
Añadir créditos
$10
≈ 4 pruebas
$50
≈ 20 pruebas
$100
≈ 40 pruebas
ModeloCategoríaPrecio
Facturación por tokensEntrada
$2.5
1M tokens
Salida
$12
1M tokens

Por qué reAPI

Por debajo de la tarifa publicada, en ambas direcciones

Moonshot publica una tarifa por millón de tokens para la entrada y la salida de Kimi K3. En reAPI, Kimi K3 queda por debajo en ambas, y un quinto entero por debajo en salida: sin suscripción debajo, sin compromiso mínimo, pago por uso en USD contra el saldo de tu pasarela. Las cifras exactas están en la tabla de precios de esta página.

Compatible con OpenAI, sustitución directa

Kimi K3 se sirve desde un endpoint `/v1/chat/completions` estándar, y el propio quickstart de Moonshot mueve el modelo a través del SDK de OpenAI: la compatibilidad es diseño del proveedor y no una capa nuestra. Adoptar Kimi K3 es una base URL, una clave y una cadena de modelo. Sin cambiar de SDK, y nada de Kimi K3 necesita un cliente a medida.

Una clave para Kimi, Claude, GPT y Gemini

La misma clave de api.reapi.ai que llama a Kimi K3 llama también a las familias Claude, GPT y Gemini. Enfrentar a Kimi K3 con un modelo de frontera cerrado, o desviar el tráfico cuando un proveedor tiene una mala hora, es una cadena de modelo en lugar de una segunda integración, una segunda factura y un segundo juego de credenciales.

Kimi K3 frente a Claude Opus 5

En reAPI estos dos caen prácticamente en la misma tarifa por token, lo que convierte al precio en la parte menos interesante de la comparación. Lo que cambia es la forma: Kimi K3 es el modelo de pesos abiertos que razona siempre, devuelve su texto de razonamiento y acepta entrada de vídeo, mientras Claude Opus 5 es el modelo cerrado con una escala de esfuerzo más fina que se guarda su razonamiento. Dos de estas filas son las que rompen código traído de otro proveedor: en Kimi K3 el pensamiento no se puede apagar, y su texto de razonamiento hay que devolverlo en los historiales de varios turnos.

Capacidad
Kimi K3 en reAPI
Claude Opus 5
Pesos
Abiertos — Moonshot lo llama el primer modelo de código abierto de la clase de tres billones de parámetros
Cerrados — solo acceso por API
Límites de contexto y salida
Contexto de 1.048.576 tokens; salida en 131.072 por defecto y elevable a la ventana completa
Contexto de 1M tokens; salida máxima de 128k, fija
Pensamiento
Siempre activo y no desactivable — baja el esfuerzo en su lugar
Activo por defecto, y desactivable con esfuerzo high o inferior
Escala de esfuerzo
Tres peldaños — low, high, max — con max por defecto
Cinco peldaños de low a max, con high por defecto
Texto de razonamiento
Se devuelve junto a la respuesta, y se exige de vuelta en la siguiente petición
El razonamiento en bruto nunca se devuelve; un resumen legible si se pide
Entrada visual
Imágenes y vídeo, como base64 o archivo subido — URL públicas rechazadas
Imágenes y PDF; sin entrada de vídeo

La comparación refleja el comportamiento documentado por cada proveedor en el momento de escribir. Las tarifas se describen como relaciones y no como importes; las cifras vigentes de Kimi K3 están en la tabla de precios de arriba.

Poner Kimi K3 en producción en tres pasos

  1. step 01

    Crear cuenta y clave en api.reapi.ai

    Regístrate en api.reapi.ai, abre la consola y genera una API key. Esa única clave llega a Kimi K3 y a todos los demás modelos de la pasarela, facturados desde un único saldo.

    Abrir
  2. step 02

    Apuntar tu cliente a la pasarela

    Pon tu base URL en api.reapi.ai y tu clave en la que acabas de crear. Cualquier cliente que ya hable OpenAI Chat Completions funciona sin cambios: no hace falta cambiar de SDK para llegar a Kimi K3.

    Abrir
  3. step 03

    Enviar `kimi-k3` como modelo

    Pon el campo model en `kimi-k3` y envía tus messages. Activa el streaming para salidas largas, quita cualquier temperature o top_p que estuvieras mandando y elige un esfuerzo de razonamiento: Kimi K3 siempre piensa, y el peldaño por defecto es el más caro.

    Abrir
docs/api/kimi-k3

Referencia de API

Código listo para usar y la tabla completa de parámetros.

curl https://api.reapi.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "group": "default",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "high",
    "stream": true
  }'

Validación de parámetros fallida

Rechazado de forma síncrona con el campo problemático indicado. Revisa enums, rangos y campos de URL — no se cobra nada.

Problema de autenticación o saldo

401 significa clave Bearer ausente o inválida; 402, que la reserva supera tu saldo. Gestiona claves y créditos en la consola.

Contenido o material rechazado

El material de referencia y las salidas pasan una moderación automática. Las tareas rechazadas fallan con un error claro y reembolso completo.

Tarea fallida o con timeout

Una tarea que llega a estado fallido nunca se cobra: la reserva se reembolsa automáticamente. Guarda el ID y reintenta.

Preguntas frecuentes

Dudas comunes sobre este modelo.

Kimi K3 se factura por uso en USD por token contra tu saldo de api.reapi.ai, con tarifas separadas de entrada y salida y sin suscripción. Ambas quedan por debajo de la tarifa por token publicada por Moonshot, la de salida en un quinto entero. Las cifras actuales están en la tabla de precios de esta página.

start building

¿Listo para lanzar?

Pruébalo en el playground o consigue una API key para integrarlo ahora.