Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references

GPT-5.6 Luna — contexto de 1,05M en el nivel de volumen

GPT-5.6 Luna es el nivel sensible al coste de OpenAI dentro de la familia GPT-5.6, y lo interesante es lo que no sacrifica: GPT-5.6 Luna lleva la misma ventana de contexto de 1.050.000 tokens, la misma salida máxima de 128.000 tokens y el mismo dial de razonamiento de seis peldaños que su hermano de frontera. Lo que cambia es el precio y la profundidad de pensamiento que tiene sentido pedirle. En reAPI, GPT-5.6 Luna se factura por debajo de la tarifa publicada por OpenAI, tanto en entrada como en salida.

Características
Niveles de esfuerzo de razonamiento · herramientas y modo JSON
Ideal para
Respuestas rápidas, tareas cotidianas
Entrada
Mensajes de chat (compatible con OpenAI)
Salida
Texto, streaming opcional
GPT-5.6 Luna

Preguntar a GPT-5.6 Luna

Empieza con el texto del compositor o elige un ejemplo.

Enter para enviar · Mayús+Enter para una nueva línea

¿Qué es la API de GPT-5.6 Luna?

GPT-5.6 Luna es el nivel sensible al coste de la familia GPT-5.6 y en reAPI se sirve mediante un endpoint /api/v1/chat/completions compatible con OpenAI. No renuncia a ninguno de los límites de la familia: la misma ventana de contexto de 1.050.000 tokens, la misma salida máxima de 128.000 tokens y los mismos seis peldaños de esfuerzo de razonamiento, de none a max, con medium por defecto, con entrada de texto e imagen y salida de texto. La facturación es por 1M tokens, con entrada y salida tarifadas por separado; los tokens de razonamiento cuentan como salida.

Lo que puedes construir con este modelo

Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

GPT-5.6 Luna clasificando una cola de documentos con el razonamiento apagado

Clasificación y extracción, con precio para la cola completa

Este es el trabajo que OpenAI nombra para el nivel de esfuerzo más bajo: recuperación rápida de información y clasificación, donde el razonamiento solo añade latencia. Apaga el esfuerzo, ata la salida con un esquema y GPT-5.6 Luna pasa a ser un componente en lugar de un oráculo: el mismo prompt sobre un millón de filas, a una tarifa donde la aritmética sigue funcionando. Lo que conviene notar es que bajar a este nivel no reduce tus entradas: GPT-5.6 Luna lee la misma ventana de 1.050.000 tokens que el nivel de frontera, así que un documento largo no te obliga a subir la escalera de precios solo para que quepa.

Leer la documentación de la API
GPT-5.6 Luna filtrando peticiones y escalando solo las difíciles

La primera pasada barata delante de un modelo caro

La mayor parte del tráfico de producción no es difícil. Una ruta de dos etapas construida sobre GPT-5.6 Luna — lee todo y decide qué es rutinario, y un modelo más caro solo ve el resto — es la palanca de coste individual más eficaz en una carga conversacional. Y funciona precisamente porque la etapa barata aquí no es un modelo débil, sino un nivel más pequeño de la misma familia con los mismos límites y la misma interfaz. Misma clave, mismo endpoint, una cadena de modelo de diferencia: escalar es un campo de tu petición, no una segunda integración.

GPT-5.6 Luna respondiendo a una petición sensible a la latencia sin pasada de razonamiento

Rutas críticas en latencia donde pensar es la herramienta equivocada

Voz, autocompletado, moderación en directo, cualquier cosa que una persona esté esperando: el consejo de OpenAI para esto es probar primero low y pasar a none si hace falta. GPT-5.6 Luna es el nivel donde seguir ese consejo cuesta menos, y donde la velocidad ya viene calificada como Fast. Mantén el prompt corto, acota la salida y trata el esfuerzo como el mando que giras antes de irte a buscar otro proveedor: el camino rápido y el camino profundo de la familia son la misma API.

Precios

Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.

Coste de la primera prueba
$0.00111.12 credits

Un prompt de 1K tokens con una respuesta de 1K tokens en el nivel más barato.

Guía de presupuesto de pruebas
Añadir créditos
$10
≈ 8928 pruebas
$50
≈ 44642 pruebas
$100
≈ 89285 pruebas
ModeloCategoríaPrecio
Facturación por tokensEntrada
$0.16
1M tokens
Salida
$0.96
1M tokens
Contexto largo · prompts sobre 272K tokensEntrada
$0.32
1M tokens
Salida
$1.44
1M tokens

Por qué reAPI

Por debajo de la tarifa publicada

OpenAI publica una tarifa por millón de tokens para la entrada y la salida de GPT-5.6 Luna. En reAPI, GPT-5.6 Luna queda por debajo en ambas, y las tarifas de esta página se actualizan en vivo. Sin suscripción por debajo, sin compromiso mínimo, pago por uso desde tu saldo de reAPI. Las cifras exactas están en la tabla de precios de esta página.

Compatible con OpenAI, sustitución directa

GPT-5.6 Luna se sirve desde un endpoint `/api/v1/chat/completions` estándar. Si tu código ya habla ese formato, adoptar GPT-5.6 Luna es una base URL, una clave y una cadena de modelo: los mismos SDK funcionan en cuanto la base URL apunta a reapi.ai. Sin cambiar de SDK y sin cliente a medida.

Una clave para toda la escalera

La misma clave de reAPI que llama a GPT-5.6 Luna llama también a sus hermanos mayores, a las familias Claude y Gemini y a los niveles de pesos abiertos. Eso es lo que hace practicable el enrutado por niveles: el destino de escalado es una cadena de modelo, no una segunda relación con un proveedor, con su factura y sus credenciales.

GPT-5.6 Luna frente a GPT-5.6 Terra

Esta es la comparación que de verdad decide una ruta, y es inusualmente limpia porque GPT-5.6 Luna y GPT-5.6 Terra comparten casi todo: la misma ventana de contexto, el mismo techo de salida, la misma escala de esfuerzo, las mismas herramientas, el mismo corte de conocimiento, el mismo endpoint. Lo que difiere es el margen de razonamiento que OpenAI atribuye a cada uno, la línea de la que descienden y el precio. Lee las filas de abajo así: ¿esta ruta necesita criterio o rendimiento?

Capacidad
GPT-5.6 Luna en reAPI
GPT-5.6 Terra
Posicionamiento de OpenAI
Optimizado para cargas sensibles al coste y de alto volumen
Equilibra inteligencia y coste
Calificación de razonamiento
High — la calificación de entrada de la familia
Higher — un escalón por encima
Línea de la generación anterior
Corresponde al nivel nano de familias GPT-5 anteriores
Corresponde al nivel mini
Tarifa en reAPI
La más baja de los tres niveles — consulta la tabla de precios de arriba
Más alta que Luna, más baja que el nivel de frontera
Límites de contexto y salida
Contexto de 1.050.000 tokens, salida máxima de 128.000 tokens
Idénticos — los límites no cambian entre niveles
Escala de esfuerzo y herramientas
Los seis peldaños, funciones, búsqueda web, búsqueda de archivos, uso del ordenador
Idénticos — la diferencia es qué peldaños vale la pena pagar

La comparación refleja el comportamiento documentado por OpenAI en sus propias páginas de modelos en el momento de escribir. Las tarifas se describen como relaciones y no como importes; las cifras vigentes de GPT-5.6 Luna están en la tabla de precios de arriba.

Poner GPT-5.6 Luna en producción en tres pasos

  1. step 01

    Crear una API key de reAPI

    Inicia sesión en reAPI y crea una clave en API keys. Esa única clave llega a GPT-5.6 Luna y a todos los demás modelos de la plataforma, facturados desde un único saldo.

    Abrir
  2. step 02

    Apuntar tu cliente a reapi.ai

    Pon tu base URL en la API de reapi.ai y tu clave en la que acabas de crear. Cualquier cliente que ya hable OpenAI Chat Completions funciona sin cambios: no hace falta cambiar de SDK para llegar a GPT-5.6 Luna.

    Abrir
  3. step 03

    Enviar `gpt-5.6-luna` como modelo

    Pon el campo model en `gpt-5.6-luna` — con los puntos — y envía tus messages. En este nivel fija el esfuerzo de razonamiento a propósito: el valor por defecto de la familia es medium, y en rutas de alto volumen lo que de verdad quieres suele ser none o low.

    Abrir
docs/api/gpt-5-6-luna

Referencia de API

Código listo para usar y la tabla completa de parámetros.

curl https://reapi.ai/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-luna",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "low",
    "stream": true
  }'

Validación de parámetros fallida

Rechazado de forma síncrona con el campo problemático indicado. Revisa enums, rangos y campos de URL — no se cobra nada.

Problema de autenticación o saldo

401 significa clave Bearer ausente o inválida; 402, que la reserva supera tu saldo. Gestiona claves y créditos en la consola.

Contenido o material rechazado

El material de referencia y las salidas pasan una moderación automática. Las tareas rechazadas fallan con un error claro y reembolso completo.

Tarea fallida o con timeout

Una tarea que llega a estado fallido nunca se cobra: la reserva se reembolsa automáticamente. Guarda el ID y reintenta.

Preguntas frecuentes

Dudas comunes sobre este modelo.

GPT-5.6 Luna se factura por uso por token desde tu saldo de reAPI, con tarifas separadas de entrada y salida y sin suscripción. Ambas quedan por debajo de la tarifa por token publicada por OpenAI. Las cifras actuales están en la tabla de precios de esta página.

start building

¿Listo para lanzar?

Pruébalo en el playground o consigue una API key para integrarlo ahora.