GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
GPT-6 Luna API precios: tarifas por token y calculadora de costes
2026/10/07

GPT-6 Luna API precios: tarifas por token y calculadora de costes

Precios de la GPT-6 Luna API según OpenAI: input, output, lecturas y escrituras de caché, el tramo de 272K, Batch y Fast, y ejemplos de coste resueltos.

Los precios de la GPT-6 Luna API empiezan en $0.10 por millón de tokens de input y $0.50 por millón de tokens de output en el tier Standard de OpenAI, las tarifas más bajas de la gama GPT-6[1]. Sin embargo, esas dos cifras son solo una parte de la factura. El input en caché, las escrituras de caché, una tarifa aparte para prompts de más de 272K tokens y los tokens de reasoning que se facturan como output pueden mover el coste real.

Esta guía recoge todas las tarifas de GPT-6 Luna de la página de precios de OpenAI, consultada el 7 de octubre de 2026, explica cómo se calcula el precio de una solicitud y desarrolla cinco escenarios de coste con sus supuestos por escrito, para que pueda rehacer las cuentas con sus propios recuentos de tokens.

TL;DR

  • Tarifas Standard por 1M de tokens: $0.10 de input, $0.01 de input en caché, $0.125 de escrituras de caché, $0.50 de output[1].
  • Por encima de 272K tokens de input, toda la solicitud pasa a $0.20 de input, $0.02 de input en caché, $0.25 de escrituras de caché y $0.75 de output[1][2].
  • Batch y Flex cuestan la mitad que Standard; Fast mode cuesta el doble; el procesamiento regional añade un 10%[2].
  • Los tokens de reasoning se facturan como output, así que el reasoning effort es la mayor palanca después del volumen[3].
  • Una solicitud corta es barata: 500 tokens de input y 10 de output cuestan $0.000055 con tarifas Standard, es decir, $55 por millón de solicitudes así (cálculo nuestro, detallado más abajo).
  • Frente al resto de GPT-6: las tarifas Standard de Astra son exactamente 100 veces las de Luna, y el input y el output de GPT-6 Sol son 20 veces[1].

Precios de la GPT-6 Luna API para cada tipo de token

OpenAI fija el precio de GPT-6 Luna por tipo de token y por longitud del prompt. "Short context" llega hasta 272K tokens de input; por encima, las tarifas de contexto largo se aplican a toda la solicitud[1].

Por 1M de tokens (Standard)Hasta 272K de inputMás de 272K de input
Input$0.10$0.20
Input en caché$0.01$0.02
Escrituras de caché$0.125$0.25
Output$0.50$0.75

Fuente: OpenAI API pricing, tier Standard[1].

La página del modelo indica los multiplicadores detrás de estas cifras. El input en caché cuesta el 10% de la tarifa de input sin caché, las escrituras de caché 1.25 veces esa tarifa, y los prompts con más de 272K tokens de input "se cobran a 2x las tarifas de input y caché y a 1.5x el output para toda la solicitud"[2].

Batch, Flex, Fast y procesamiento regional

El tier de procesamiento cambia cada tarifa por un factor fijo. La página del modelo de OpenAI dice que "Batch y Flex se cobran al 50% de las tarifas Standard. Fast mode se cobra a 2x las tarifas aplicables", y que el procesamiento regional "añade un recargo del 10% donde está disponible"[2].

Por 1M de tokens, hasta 272K de inputInputInput en cachéEscrituras de cachéOutput
Standard$0.10$0.01$0.125$0.50
Batch$0.05$0.005$0.0625$0.25
Flex$0.05$0.005$0.0625$0.25
Fast$0.20$0.02$0.25$1.00

Fuente: OpenAI API pricing, tablas Standard, Batch, Flex y Fast[1].

Batch encaja en trabajos offline como clasificaciones nocturnas o backfills. Fast mode es la opción de OpenAI para tráfico sensible a la latencia, y OpenAI indica que no está disponible con residencia de datos en la UE para GPT-6 Luna[4].

Cómo se calcula el precio de una solicitud a GPT-6 Luna

Para un prompt de 272K tokens de input o menos, con tarifas Standard:

cost = ( uncached_input × 0.10
       + cached_input   × 0.01
       + cache_write    × 0.125
       + output         × 0.50 ) / 1,000,000

Por encima de 272K tokens de input, sustituya por 0.20, 0.02, 0.25 y 0.75 para toda la solicitud. Cuatro reglas deciden en qué partida cae cada token.

Los tokens de reasoning son output. OpenAI afirma que los tokens de reasoning "ocupan espacio en la ventana de contexto del modelo y se facturan como tokens de output"[3]. GPT-6 Luna admite seis niveles de effort, de none a max, con medium como valor por defecto[2]. Una etiqueta de clasificación de dos palabras puede llevar detrás cientos de tokens de reasoning facturados.

Los cargos de caché sustituyen a la tarifa de input en lugar de sumarse a ella. La guía de caching de OpenAI dice que el precio de las escrituras de caché "no es una tarifa adicional: los tokens de input usan la tarifa de input sin caché, de input en caché o de escritura de caché"[5].

Los prefijos cortos nunca se almacenan en caché. La longitud mínima de prompt cacheable es de 1,024 tokens para GPT-5.6 y modelos posteriores, y un prefijo en caché sigue siendo utilizable durante al menos 30 minutos después de su última escritura o reutilización[5].

El umbral de 272K es por solicitud. Un prompt de 300K tokens de input se factura entero con tarifas de contexto largo, output incluido[2].

Calculadora de costes de la GPT-6 Luna API: cinco ejemplos resueltos

Cada fila usa las tarifas de lista de OpenAI indicadas arriba. Los recuentos de tokens son supuestos elegidos a modo de ilustración, no mediciones. Sustitúyalos por las cifras del objeto usage de sus propias respuestas.

EscenarioSupuestosCálculoTotal
A. Etiquetado de tickets, effort none1,000,000 solicitudes × 500 de input, 10 de output500M × $0.10 + 10M × $0.50 = $50 + $5$55.00
B. Mismo trabajo, effort mediumIgual que A, más 300 tokens de reasoning supuestos por solicitud500M × $0.10 + 310M × $0.50 = $50 + $155$205.00
C. Escenario A mediante BatchIgual que A, con tarifas Batch500M × $0.05 + 10M × $0.25 = $25 + $2.50$27.50
D. Asistente de soporte con prefijo en caché100,000 solicitudes; prefijo estable de 4,000 tokens escrito 1,000 veces y leído 99,000 veces; 1,000 tokens de input nuevos y 400 de output en cada una396M × $0.01 + 4M × $0.125 + 100M × $0.10 + 40M × $0.50 = $3.96 + $0.50 + $10 + $20$34.46
E. Documentos largos1,000 solicitudes × 400,000 de input, 2,000 de output (tier de contexto largo)400M × $0.20 + 2M × $0.75 = $80 + $1.50$81.50

Destacan tres conclusiones.

Aquí el effort cuesta más que el volumen. En B, la pasada de reasoning supuesta convierte el output en la partida más grande, y el trabajo cuesta 3.7 veces el escenario A. Compruebe si none o low cumplen su objetivo de precisión antes de pagar por medium.

El caching reduce a la mitad el escenario D. Sin caché, el mismo tráfico cuesta 500M × $0.10 + 40M × $0.50 = $70.00. Las lecturas de caché bajan el prefijo de $40 a $4.46, escrituras incluidas.

El umbral de 272K duplica el input. Si cada documento de E pudiera dividirse en dos solicitudes de 200,000 tokens con 2,000 tokens de output cada una, la factura sería 400M × $0.10 + 4M × $0.50 = $42.00. Dividir cambia lo que el modelo ve de una vez, así que compruebe la calidad antes de perseguir el ahorro.

Cómo se comparan los precios de GPT-6 Luna con otros modelos GPT

Todas las tarifas Standard por 1M de tokens para prompts de hasta 272K tokens de input[1]:

ModeloInputInput en cachéEscrituras de cachéOutput
GPT-6 Luna$0.10$0.01$0.125$0.50
GPT-5.6 Luna$0.20$0.02$0.25$1.20
GPT-6 Sol$2.00$0.20$2.50$10.00
GPT-6.1 Sol$2.00$0.10$2.50$10.00
GPT-6 Astra$10.00$1.00$12.50$50.00

OpenAI atribuye el bajo precio de Luna a "mejoras en caching e inferencia", trasladadas como una rebaja respecto a los precios de GPT-5.6[6]. Las ventajas e inconvenientes de cada modelo se tratan en GPT-6 Luna vs 5.6 Luna y GPT-6 Sol vs Luna; las tarifas de Sol están en GPT-6 Sol pricing.

Pagar GPT-6 Luna a través de reAPI

reAPI ofrece GPT-6 Luna en su endpoint de Chat Completions con el id de modelo gpt-6-luna, facturado por token desde su saldo de créditos de reAPI. Input, output, lectura de caché y escritura de caché tienen cada uno su propia tarifa, los tokens de reasoning se facturan como output y los prompts de más de 272K tokens de input recalculan el precio de toda la solicitud[7]. El objeto usage de cada respuesta informa de prompt_tokens, completion_tokens (reasoning incluido) y cached_tokens, para que pueda conciliar la factura con la fórmula anterior[7].

Las tarifas por token vigentes de reAPI y un estimador de costes para tokens de input y output están en la página del modelo GPT-6 Luna. Una nota sobre el formato de la solicitud: enviar temperature a GPT-6 Luna devuelve 400, tema que se trata en GPT-6 Luna temperature.

FAQ

¿Cuánto cuesta chat gpt 6?

En la API, GPT-6 se cobra por token según el modelo: GPT-6 Luna a $0.10 de input y $0.50 de output por 1M de tokens, GPT-6 Sol y GPT-6.1 Sol a $2 y $10, y GPT-6 Astra a $10 y $50[1]. En ChatGPT, OpenAI puso GPT-6 Sol y Luna a disposición de los usuarios Plus, Pro, Business, Enterprise y Edu, y los usuarios Free y Go pueden usar GPT-6 Luna en la app de escritorio[6].

Precio de gpt 6 luna para 10000 tokens

Con tarifas Standard, 10,000 tokens de input cuestan $0.001 y 10,000 tokens de output cuestan $0.005[1]. Si esos 10,000 tokens de input fueran lecturas de caché, costarían $0.0001.

Coste de los tokens de output de gpt 6 luna

El output cuesta $0.50 por 1M de tokens para prompts de hasta 272K tokens de input y $0.75 por encima, con tarifas Standard[1]. Los tokens de reasoning están incluidos en el output facturado[3].

Descuentos de precio de gpt 6 luna

OpenAI indica dos: Batch y Flex al 50% de las tarifas Standard, y el input en caché al 10% de la tarifa de input sin caché[2]. Fast mode y el procesamiento regional van en la dirección contraria, a 2x y +10%.

gpt 6 luna gratis

En la API, GPT-6 Luna se factura por token a las tarifas indicadas arriba[1]. En ChatGPT, OpenAI dice que los usuarios Free y Go pueden acceder a GPT-6 Luna en la app de escritorio[6].

Coste de la API de gpt 6 luna vs gpt 6 astra

Las tarifas Standard de GPT-6 Astra son $10 de input, $1 de input en caché, $12.50 de escrituras de caché y $50 de output por 1M de tokens, exactamente 100 veces cada tarifa de GPT-6 Luna[1]. Astra también ofrece un tier Ultrafast a precios más altos; Luna no aparece en esa tabla[1].

¿Cuánto cuesta una API de GPT?

Depende del modelo. En la tabla Standard actual de OpenAI, las tarifas van desde los $0.10 de input y $0.50 de output por 1M de tokens de GPT-6 Luna hasta los $30 de input y $180 de output de GPT-5.5 Pro y GPT-5.4 Pro[1].

Mantener predecibles los costes de GPT-6 Luna

La mayor parte de una factura de GPT-6 Luna depende de tres decisiones: el reasoning effort que envía, si su prefijo de prompt estable es lo bastante largo para almacenarse en caché y si algún prompt concreto supera los 272K tokens de input. Mida cada una con datos reales de usage sobre una muestra de tráfico y luego introduzca esos recuentos en la fórmula. Con eso, los precios de la GPT-6 Luna API son fáciles de prever: $0.10 de entrada, $0.50 de salida, y cada excepción queda documentada.

References

  1. OpenAI. API pricing. Consultado en octubre de 2026 en developers.openai.com/api/docs/pricing
  2. OpenAI. GPT-6 Luna model page. Consultado en octubre de 2026 en developers.openai.com/api/docs/models/gpt-6-luna
  3. OpenAI. Reasoning models. Consultado en octubre de 2026 en developers.openai.com/api/docs/guides/reasoning
  4. OpenAI. Fast mode. Consultado en octubre de 2026 en developers.openai.com/api/docs/guides/fast-mode
  5. OpenAI. Prompt caching. Consultado en octubre de 2026 en developers.openai.com/api/docs/guides/prompt-caching
  6. OpenAI. Introducing GPT-6 Sol and Luna. Consultado en octubre de 2026 en openai.com/index/introducing-gpt-6-sol-and-luna
  7. reAPI. GPT-6 Luna API docs. Consultado en octubre de 2026 en reapi.ai/docs/gpt-6-luna