
OpenAI
GPT-5.4
Desde $1.00 por 1M tokens
GPT-5.6 Luna es el nivel sensible al coste de OpenAI dentro de la familia GPT-5.6, y lo interesante es lo que no sacrifica: GPT-5.6 Luna lleva la misma ventana de contexto de 1.050.000 tokens, la misma salida máxima de 128.000 tokens y el mismo dial de razonamiento de seis peldaños que su hermano de frontera. Lo que cambia es el precio y la profundidad de pensamiento que tiene sentido pedirle. En reAPI, GPT-5.6 Luna se factura por debajo de la tarifa publicada por OpenAI, tanto en entrada como en salida.
Empieza con el texto del compositor o elige un ejemplo.
GPT-5.6 Luna es el nivel sensible al coste de la familia GPT-5.6 y en reAPI se sirve mediante un endpoint /api/v1/chat/completions compatible con OpenAI. No renuncia a ninguno de los límites de la familia: la misma ventana de contexto de 1.050.000 tokens, la misma salida máxima de 128.000 tokens y los mismos seis peldaños de esfuerzo de razonamiento, de none a max, con medium por defecto, con entrada de texto e imagen y salida de texto. La facturación es por 1M tokens, con entrada y salida tarifadas por separado; los tokens de razonamiento cuentan como salida.
Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

Este es el trabajo que OpenAI nombra para el nivel de esfuerzo más bajo: recuperación rápida de información y clasificación, donde el razonamiento solo añade latencia. Apaga el esfuerzo, ata la salida con un esquema y GPT-5.6 Luna pasa a ser un componente en lugar de un oráculo: el mismo prompt sobre un millón de filas, a una tarifa donde la aritmética sigue funcionando. Lo que conviene notar es que bajar a este nivel no reduce tus entradas: GPT-5.6 Luna lee la misma ventana de 1.050.000 tokens que el nivel de frontera, así que un documento largo no te obliga a subir la escalera de precios solo para que quepa.
Leer la documentación de la API
La mayor parte del tráfico de producción no es difícil. Una ruta de dos etapas construida sobre GPT-5.6 Luna — lee todo y decide qué es rutinario, y un modelo más caro solo ve el resto — es la palanca de coste individual más eficaz en una carga conversacional. Y funciona precisamente porque la etapa barata aquí no es un modelo débil, sino un nivel más pequeño de la misma familia con los mismos límites y la misma interfaz. Misma clave, mismo endpoint, una cadena de modelo de diferencia: escalar es un campo de tu petición, no una segunda integración.

Voz, autocompletado, moderación en directo, cualquier cosa que una persona esté esperando: el consejo de OpenAI para esto es probar primero low y pasar a none si hace falta. GPT-5.6 Luna es el nivel donde seguir ese consejo cuesta menos, y donde la velocidad ya viene calificada como Fast. Mantén el prompt corto, acota la salida y trata el esfuerzo como el mando que giras antes de irte a buscar otro proveedor: el camino rápido y el camino profundo de la familia son la misma API.
Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.
Un prompt de 1K tokens con una respuesta de 1K tokens en el nivel más barato.
| Modelo | Categoría | Precio |
|---|---|---|
| Facturación por tokens | Entrada | $0.16 1M tokens |
| Salida | $0.96 1M tokens | |
| Contexto largo · prompts sobre 272K tokens | Entrada | $0.32 1M tokens |
| Salida | $1.44 1M tokens |
OpenAI publica una tarifa por millón de tokens para la entrada y la salida de GPT-5.6 Luna. En reAPI, GPT-5.6 Luna queda por debajo en ambas, y las tarifas de esta página se actualizan en vivo. Sin suscripción por debajo, sin compromiso mínimo, pago por uso desde tu saldo de reAPI. Las cifras exactas están en la tabla de precios de esta página.
GPT-5.6 Luna se sirve desde un endpoint `/api/v1/chat/completions` estándar. Si tu código ya habla ese formato, adoptar GPT-5.6 Luna es una base URL, una clave y una cadena de modelo: los mismos SDK funcionan en cuanto la base URL apunta a reapi.ai. Sin cambiar de SDK y sin cliente a medida.
La misma clave de reAPI que llama a GPT-5.6 Luna llama también a sus hermanos mayores, a las familias Claude y Gemini y a los niveles de pesos abiertos. Eso es lo que hace practicable el enrutado por niveles: el destino de escalado es una cadena de modelo, no una segunda relación con un proveedor, con su factura y sus credenciales.
Esta es la comparación que de verdad decide una ruta, y es inusualmente limpia porque GPT-5.6 Luna y GPT-5.6 Terra comparten casi todo: la misma ventana de contexto, el mismo techo de salida, la misma escala de esfuerzo, las mismas herramientas, el mismo corte de conocimiento, el mismo endpoint. Lo que difiere es el margen de razonamiento que OpenAI atribuye a cada uno, la línea de la que descienden y el precio. Lee las filas de abajo así: ¿esta ruta necesita criterio o rendimiento?
La comparación refleja el comportamiento documentado por OpenAI en sus propias páginas de modelos en el momento de escribir. Las tarifas se describen como relaciones y no como importes; las cifras vigentes de GPT-5.6 Luna están en la tabla de precios de arriba.
Inicia sesión en reAPI y crea una clave en API keys. Esa única clave llega a GPT-5.6 Luna y a todos los demás modelos de la plataforma, facturados desde un único saldo.
AbrirPon tu base URL en la API de reapi.ai y tu clave en la que acabas de crear. Cualquier cliente que ya hable OpenAI Chat Completions funciona sin cambios: no hace falta cambiar de SDK para llegar a GPT-5.6 Luna.
AbrirPon el campo model en `gpt-5.6-luna` — con los puntos — y envía tus messages. En este nivel fija el esfuerzo de razonamiento a propósito: el valor por defecto de la familia es medium, y en rutas de alto volumen lo que de verdad quieres suele ser none o low.
Abrircurl https://reapi.ai/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-luna",
"messages": [
{ "role": "user", "content": "Hello" }
],
"reasoning_effort": "low",
"stream": true
}'Rechazado de forma síncrona con el campo problemático indicado. Revisa enums, rangos y campos de URL — no se cobra nada.
401 significa clave Bearer ausente o inválida; 402, que la reserva supera tu saldo. Gestiona claves y créditos en la consola.
El material de referencia y las salidas pasan una moderación automática. Las tareas rechazadas fallan con un error claro y reembolso completo.
Una tarea que llega a estado fallido nunca se cobra: la reserva se reembolsa automáticamente. Guarda el ID y reintenta.
Dudas comunes sobre este modelo.
Explora más modelos de la misma categoría.

OpenAI
Desde $1.00 por 1M tokens

OpenAI
Desde $1.60 por 1M tokens

OpenAI
Desde $3.20 por 1M tokens

OpenAI
Desde $8.00 por 1M tokens
Pruébalo en el playground o consigue una API key para integrarlo ahora.