
Anthropic
Claude Opus 5
Desde $2.40 por 1M tokens
Kimi K3 es el modelo insignia de Moonshot para programación de horizonte largo y trabajo de conocimiento de extremo a extremo. Kimi K3 lee una ventana de contexto de 1.048.576 tokens, razona siempre y ofrece un dial de esfuerzo de razonamiento de tres peldaños, de low a max. La visión nativa cubre imágenes y vídeo, los pesos son abiertos y en reAPI Kimi K3 se factura por debajo de la tarifa por token publicada por Moonshot, tanto en entrada como en salida.
kimi-k3Los modelos de chat se ejecutan en la pasarela api.reapi.ai, que tiene su propia consola y su propia clave. Abre la consola para ejecutar Kimi K3 a través de la interfaz Chat Completions compatible con OpenAI.
Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

Moonshot sitúa a Kimi K3 en la programación de horizonte largo y lo describe sacando adelante tareas de ingeniería con mínima supervisión humana: leyendo y modificando bases de código grandes y coordinando herramientas de terminal. Lo que separa a Kimi K3 de un modelo de código solo textual es que la visión es nativa y no un añadido: las capturas y el feedback visual son entradas, y Moonshot menciona expresamente desarrollo de videojuegos, ingeniería frontend y CAD. Eso cierra un bucle que un modelo solo textual no puede cerrar, porque el modelo puede mirar lo que acaba de construir y juzgar si la maquetación está realmente mal antes de volver a editar.
Leer la documentación de la API
La ventana de contexto de Kimi K3 es de 1.048.576 tokens, y la propia FAQ de Moonshot dice que la tarifa es plana, sin escalones según la longitud del contexto: llenar la ventana cuesta por token lo que cuesta cualquier otro token. Un conjunto de contratos, un dossier de investigación o un año de presentaciones va entero a Kimi K3, lo que elimina la capa de recuperación cuyo único cometido era esquivar un contexto pequeño. El trabajo repetido lo asume después la caché de contexto: en Kimi K3 es automática, sin id de caché, sin TTL y sin parámetros extra, así que un prefijo estable delante de una pregunta cambiante es el patrón con el que construir.

Con esta generación llegaron dos controles de llamada a herramientas. Una elección de herramienta requerida fuerza al menos una llamada en el turno, que es la forma de evitar que un agente responda de memoria cuando debía ir a consultar: los modelos K2 rechazan ese valor y Kimi K3 lo acepta. Y una herramienta puede introducirse a mitad de conversación poniendo su definición completa en un mensaje de sistema, de modo que un inventario grande de herramientas no tiene que declararse por adelantado en cada petición. Las salidas estructuradas y un JSON Schema mantienen parseable lo que Kimi K3 devuelve al final del bucle.
Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.
| Categoría | Unidad | Precio |
|---|---|---|
| Facturación por tokens | ||
| Entrada | 1M tokens | $2.5 |
| Salida | 1M tokens | $12 |
Moonshot publica una tarifa por millón de tokens para la entrada y la salida de Kimi K3. En reAPI, Kimi K3 queda por debajo en ambas, y un quinto entero por debajo en salida: sin suscripción debajo, sin compromiso mínimo, pago por uso en USD contra el saldo de tu pasarela. Las cifras exactas están en la tabla de precios de esta página.
Kimi K3 se sirve desde un endpoint `/v1/chat/completions` estándar, y el propio quickstart de Moonshot mueve el modelo a través del SDK de OpenAI: la compatibilidad es diseño del proveedor y no una capa nuestra. Adoptar Kimi K3 es una base URL, una clave y una cadena de modelo. Sin cambiar de SDK, y nada de Kimi K3 necesita un cliente a medida.
La misma clave de api.reapi.ai que llama a Kimi K3 llama también a las familias Claude, GPT y Gemini. Enfrentar a Kimi K3 con un modelo de frontera cerrado, o desviar el tráfico cuando un proveedor tiene una mala hora, es una cadena de modelo en lugar de una segunda integración, una segunda factura y un segundo juego de credenciales.
En reAPI estos dos caen prácticamente en la misma tarifa por token, lo que convierte al precio en la parte menos interesante de la comparación. Lo que cambia es la forma: Kimi K3 es el modelo de pesos abiertos que razona siempre, devuelve su texto de razonamiento y acepta entrada de vídeo, mientras Claude Opus 5 es el modelo cerrado con una escala de esfuerzo más fina que se guarda su razonamiento. Dos de estas filas son las que rompen código traído de otro proveedor: en Kimi K3 el pensamiento no se puede apagar, y su texto de razonamiento hay que devolverlo en los historiales de varios turnos.
La comparación refleja el comportamiento documentado por cada proveedor en el momento de escribir. Las tarifas se describen como relaciones y no como importes; las cifras vigentes de Kimi K3 están en la tabla de precios de arriba.
Regístrate en api.reapi.ai, abre la consola y genera una API key. Esa única clave llega a Kimi K3 y a todos los demás modelos de la pasarela, facturados desde un único saldo.
AbrirPon tu base URL en api.reapi.ai y tu clave en la que acabas de crear. Cualquier cliente que ya hable OpenAI Chat Completions funciona sin cambios: no hace falta cambiar de SDK para llegar a Kimi K3.
AbrirPon el campo model en `kimi-k3` y envía tus messages. Activa el streaming para salidas largas, quita cualquier temperature o top_p que estuvieras mandando y elige un esfuerzo de razonamiento: Kimi K3 siempre piensa, y el peldaño por defecto es el más caro.
AbrirDudas comunes sobre este modelo.
Explora más modelos de la misma categoría.

Anthropic
Desde $2.40 por 1M tokens

OpenAI
Desde $2.00 por 1M de tokens

Anthropic
Desde $2.00 por 1M tokens

Anthropic
Desde $2.00 por 1M de tokens
Pruébalo en el playground o consigue una API key para integrarlo ahora.