
OpenAI
GPT-5.4
Desde $1.00 por 1M tokens
GPT-5.6 Luna es el nivel sensible al coste de OpenAI dentro de la familia GPT-5.6, y lo interesante es lo que no sacrifica: GPT-5.6 Luna lleva la misma ventana de contexto de 1.050.000 tokens, la misma salida máxima de 128.000 tokens y el mismo dial de razonamiento de seis peldaños que su hermano de frontera. Lo que cambia es el precio y la profundidad de pensamiento que tiene sentido pedirle. En reAPI, GPT-5.6 Luna se factura un 20% por debajo de la tarifa publicada por OpenAI, tanto en entrada como en salida.
gpt-5.6-lunaLos modelos de chat se ejecutan en la pasarela api.reapi.ai, que tiene su propia consola y su propia clave. Abre la consola para ejecutar GPT-5.6 Luna a través de la interfaz Chat Completions compatible con OpenAI.
Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

Este es el trabajo que OpenAI nombra para el nivel de esfuerzo más bajo: recuperación rápida de información y clasificación, donde el razonamiento solo añade latencia. Apaga el esfuerzo, ata la salida con un esquema y GPT-5.6 Luna pasa a ser un componente en lugar de un oráculo: el mismo prompt sobre un millón de filas, a una tarifa donde la aritmética sigue funcionando. Lo que conviene notar es que bajar a este nivel no reduce tus entradas: GPT-5.6 Luna lee la misma ventana de 1.050.000 tokens que el nivel de frontera, así que un documento largo no te obliga a subir la escalera de precios solo para que quepa.
Leer la documentación de la API
La mayor parte del tráfico de producción no es difícil. Una ruta de dos etapas construida sobre GPT-5.6 Luna — lee todo y decide qué es rutinario, y un modelo más caro solo ve el resto — es la palanca de coste individual más eficaz en una carga conversacional. Y funciona precisamente porque la etapa barata aquí no es un modelo débil, sino un nivel más pequeño de la misma familia con los mismos límites y la misma interfaz. Misma clave, mismo endpoint, una cadena de modelo de diferencia: escalar es un campo de tu petición, no una segunda integración.

Voz, autocompletado, moderación en directo, cualquier cosa que una persona esté esperando: el consejo de OpenAI para esto es probar primero low y pasar a none si hace falta. GPT-5.6 Luna es el nivel donde seguir ese consejo cuesta menos, y donde la velocidad ya viene calificada como Fast. Mantén el prompt corto, acota la salida y trata el esfuerzo como el mando que giras antes de irte a buscar otro proveedor: el camino rápido y el camino profundo de la familia son la misma API.
Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.
| Categoría | Unidad | Precio |
|---|---|---|
| Facturación por tokens | ||
| Entrada | 1M tokens | $0.8 |
| Salida | 1M tokens | $4.8 |
OpenAI publica una tarifa por millón de tokens para la entrada y la salida de GPT-5.6 Luna. En reAPI, GPT-5.6 Luna queda un 20% por debajo en ambas: el mismo descuento en cada dimensión, así que tu modelo de coste actual se escala con una sola cifra. Sin suscripción por debajo, sin compromiso mínimo, pago por uso en USD contra el saldo de tu pasarela. Las cifras exactas están en la tabla de precios de esta página.
GPT-5.6 Luna se sirve desde un endpoint `/v1/chat/completions` estándar. Si tu código ya habla ese formato, adoptar GPT-5.6 Luna es una base URL, una clave y una cadena de modelo: los mismos SDK funcionan en cuanto la base URL apunta a la pasarela. Sin cambiar de SDK y sin cliente a medida.
La misma clave de api.reapi.ai que llama a GPT-5.6 Luna llama también a sus hermanos mayores, a las familias Claude y Gemini y a los niveles de pesos abiertos. Eso es lo que hace practicable el enrutado por niveles: el destino de escalado es una cadena de modelo, no una segunda relación con un proveedor, con su factura y sus credenciales.
Esta es la comparación que de verdad decide una ruta, y es inusualmente limpia porque GPT-5.6 Luna y GPT-5.6 Terra comparten casi todo: la misma ventana de contexto, el mismo techo de salida, la misma escala de esfuerzo, las mismas herramientas, el mismo corte de conocimiento, el mismo endpoint. Lo que difiere es el margen de razonamiento que OpenAI atribuye a cada uno, la línea de la que descienden y el precio. Lee las filas de abajo así: ¿esta ruta necesita criterio o rendimiento?
La comparación refleja el comportamiento documentado por OpenAI en sus propias páginas de modelos en el momento de escribir. Las tarifas se describen como relaciones y no como importes; las cifras vigentes de GPT-5.6 Luna están en la tabla de precios de arriba.
Regístrate en api.reapi.ai, abre la consola y genera una API key. Esa única clave llega a GPT-5.6 Luna y a todos los demás modelos de la pasarela, facturados desde un único saldo.
AbrirPon tu base URL en api.reapi.ai y tu clave en la que acabas de crear. Cualquier cliente que ya hable OpenAI Chat Completions funciona sin cambios: no hace falta cambiar de SDK para llegar a GPT-5.6 Luna.
AbrirPon el campo model en `gpt-5.6-luna` — con los puntos — y envía tus messages. En este nivel fija el esfuerzo de razonamiento a propósito: el valor por defecto de la familia es medium, y en rutas de alto volumen lo que de verdad quieres suele ser none o low.
AbrirDudas comunes sobre este modelo.
Explora más modelos de la misma categoría.

OpenAI
Desde $1.00 por 1M tokens

OpenAI
Desde $2.00 por 1M tokens

OpenAI
Desde $4.00 por 1M tokens

OpenAI
Desde $4.00 por 1M de tokens
Pruébalo en el playground o consigue una API key para integrarlo ahora.