
API de GPT: 5 modelos 20% más baratos en reAPI
Cinco modelos GPT son 20% menos caros en reAPI que en OpenAI: GPT-5.4, GPT-5.5, Sol, Terra y Luna. Compara todas las tarifas y calcula tu ahorro.
La reducción de precio del API de GPT es fácil de malinterpretar. OpenAI no ha anunciado una reducción general en los precios de lista públicos de su API. Lo que cambió para los usuarios de reAPI es la ruta: cinco modelos GPT actuales ahora se enumeran a 20% por debajo de las tasas estándar de tokens de entrada y salida de OpenAI.
El descuento cubre GPT-5.4, GPT-5.5 y la familia completa de GPT-5.6: Sol, Terra y Luna. No hay nuevo SDK ni proyecto de migración. El código existente compatible con OpenAI puede usar las tarifas más bajas cambiando la URL base y, cuando sea necesario, el ID del modelo.
Esta guía compara todas las tarifas, calcula el ahorro en una carga de trabajo real y explica cuándo la API por lotes de OpenAI o el almacenamiento en caché de solicitudes aún pueden cambiar la respuesta.
TL;DR
- Cinco modelos GPT están 20% por debajo del precio de lista estándar de OpenAI en reAPI: GPT-5.4, GPT-5.5, GPT-5.6 Sol, GPT-5.6 Terra y GPT-5.6 Luna.
- Este es un descuento de reAPI, no un corte de precios de OpenAI. Los precios públicos actuales de OpenAI permanecen sin cambios.[1][2]
- La ruta más barata es GPT-5.6 Luna a $0.80 entrada y $4.80 salida por millón de tokens en reAPI.
- Terra y GPT-5.4 comparten el mismo precio de token en reAPI: $2 entrada y $12 salida por millón de tokens. Evalúa ambos antes de elegir.
- GPT-5.5 y GPT-5.6 Sol también comparten un precio: $4 entrada y $24 salida por millón de tokens en reAPI.
- Un descuento de 20% en tokens produce una reducción de 20% en la factura cuando la mezcla de solicitudes y el uso de tokens permanecen igual. Un modelo que usa menos tokens de salida puede reducir el costo por tarea completada más.
Precios de la API de GPT antes y después del descuento
Todos los precios a continuación están en USD por 1 millón de tokens. "Lista de OpenAI" significa procesamiento estándar, no por lotes, flexible, prioritario, procesamiento regional o un contrato empresarial negociado. Las cifras de reAPI provienen de su tarjeta de tarifas pública en vivo del 1 de agosto de 2026.[3]
| Modelo | Entrada OpenAI | Entrada reAPI | Salida OpenAI | Salida reAPI | Reducción |
|---|---|---|---|---|---|
| GPT-5.4 | $2.50 | $2.00 | $15.00 | $12.00 | 20% |
| GPT-5.5 | $5.00 | $4.00 | $30.00 | $24.00 | 20% |
| GPT-5.6 Sol | $5.00 | $4.00 | $30.00 | $24.00 | 20% |
| GPT-5.6 Terra | $2.50 | $2.00 | $15.00 | $12.00 | 20% |
| GPT-5.6 Luna | $1.00 | $0.80 | $6.00 | $4.80 | 20% |
OpenAI publica un precio de entrada en caché separado para estos modelos. La tarjeta de tarifas actual de reAPI no expone una tarifa de entrada en caché separada para las rutas predeterminadas con descuento, por lo que esta comparación no inventa una. Trata los prefijos de solicitud repetidos como una prueba separada en lugar de asumir la misma relación del 20%.
Qué significa el corte de precio de la API de GPT para una factura real
Supongamos que un agente procesa 100 millones de tokens de entrada y genera 20 millones de tokens de salida cada mes. Con uso de tokens idéntico, el cálculo mensual es:
costo mensual = entrada MTok × tarifa entrada + salida MTok × tarifa salida
| Modelo | Estándar OpenAI | reAPI | Ahorro mensual |
|---|---|---|---|
| GPT-5.4 | $550 | $440 | $110 |
| GPT-5.5 | $1,100 | $880 | $220 |
| GPT-5.6 Sol | $1,100 | $880 | $220 |
| GPT-5.6 Terra | $550 | $440 | $110 |
| GPT-5.6 Luna | $220 | $176 | $44 |
El porcentaje es constante, pero el impacto en dólares crece con el gasto. Un equipo que actualmente paga $10,000 por mes por la misma mezcla de tráfico estándar sin caché retendría aproximadamente $2,000 después de moverlo, antes de considerar cualquier cambio en el comportamiento del modelo o el consumo de tokens.
Esa última condición importa. El costo de la API no es solo el precio por token:
costo por tarea exitosa
= precio por token × tokens por intento × intentos por éxitoUn modelo más barato que necesita dos reintentos puede costar más que un modelo caro que tiene éxito una vez. Un modelo más conciso puede vencer la tabla al emitir menos tokens de salida facturables. OpenAI dice que GPT-5.6 mejora la eficiencia de tokens, por lo que una migración cuidadosamente evaluada puede ahorrar más que el descuento por token del 20% titular.[1]
¿Qué modelo GPT con descuento deberías usar?
La tabla crea dos pares de mismo precio, lo que hace que la decisión de compra sea más interesante que simplemente elegir el modelo más nuevo.
GPT-5.6 Luna: el valor predeterminado de volumen
Luna es el modelo con el precio más bajo en este grupo. OpenAI lo posiciona para trabajo de alto volumen sensible al costo, con una ventana de contexto de 1.05M tokens y un máximo de salida de 128K. Es el primer candidato para clasificación, extracción, clasificación, soporte rutinario y subtareas de agentes económicas.[4]
A $0.80 entrada y $4.80 salida por millón de tokens en reAPI, Luna es 60% más barata que Terra en ambas dimensiones. Usa la brecha de precios para ejecutar una evaluación adecuada, no para saltarte una: mide finalización de tareas, reintentos, latencia y total de tokens de salida.
GPT-5.6 Terra versus GPT-5.4: mismo precio, nivel más nuevo
Ambos cuestan $2 entrada y $12 salida por millón de tokens en reAPI. Terra es la prueba natural primera porque OpenAI lo describe como el nivel equilibrado GPT-5.6, competitivo con GPT-5.5 mientras está precificado por debajo de la insignia.[1]
GPT-5.4 sigue siendo útil cuando un indicador de solicitud de producción existente ya ha sido validado contra él. Una migración de mismo precio no es automáticamente gratuita: el comportamiento del modelo, los valores predeterminados de razonamiento, el comportamiento de caché y la longitud de la salida pueden cambiar. Ejecuta una comparación en la sombra antes de mover todo el tráfico.
GPT-5.6 Sol versus GPT-5.5: capacidad a la misma tarifa
Ambos cuestan $4 entrada y $24 salida por millón de tokens en reAPI. El precio de lista estándar de OpenAI también es idéntico para el par en $5 y $30. Sol es la nueva insignia y agrega el razonamiento actualizado de la generación GPT-5.6, uso de herramientas y controles de almacenamiento en caché de solicitud explícitos, mientras que GPT-5.5 es la línea de base estable para equipos que ya han ajustado a su alrededor.[1][2]
Para nuevas implementaciones de alta complejidad, comienza la evaluación con Sol. Mantén GPT-5.5 solo cuando las pruebas de regresión muestren que su comportamiento establecido gana en tu carga de trabajo.
Cuándo 20% de descuento no es la opción más barata
Una tabla de precios limpia es útil, pero tres detalles de facturación pueden revertir una comparación estrecha.
Procesamiento por lotes y flexible
OpenAI ofrece procesamiento por lotes y flexible a 50% de las tarifas estándar para GPT-5.4 y GPT-5.5, y procesamiento por lotes para solicitudes GPT-5.6 compatibles.[2][5] Si una carga de trabajo puede esperar y no necesita una respuesta inmediata, compara esos precios asincróicos con la tarifa activa de reAPI en lugar de comparar solo procesamiento estándar.
El descuento de reAPI del 20% es más directamente relevante para tráfico de API síncrono y estándar. Un trabajo de enriquecimiento offline nocturno tiene economías diferentes de un agente de codificación en vivo.
Almacenamiento en caché de solicitudes
OpenAI enumera lecturas en caché para GPT-5.6 a 10% del precio de entrada sin caché. GPT-5.6 también factura escrituras de caché explícitas a 1.25 veces la tarifa de entrada sin caché, por lo que el resultado neto depende de qué tan a menudo se reutiliza el prefijo.[1]
Para un mensaje de sistema largo reutilizado cientos de veces, la tasa de acierto de caché puede importar más que una reducción del 20% en el precio de entrada ordinario. Rastrea entrada sin caché, tokens de escritura de caché, tokens de lectura de caché y salida por separado.
Solicitudes de contexto largo
Para GPT-5.4 y modelos GPT-5.6 con ventanas de contexto de 1.05M, OpenAI factura solicitudes con más de 272K tokens de entrada a 2x entrada y 1.5x salida para la solicitud completa.[4][6] La tarjeta de tarifas pública de reAPI muestra proporciones de modelo base, no un ejemplo de factura de contexto largo completo. Si tus solicitudes cruzan ese umbral, prueba una solicitud representativa y verifica el uso facturado antes de proyectar ahorros.
Cómo usar las tarifas más bajas de la API de GPT
reAPI expone un punto final compatible con OpenAI, por lo que el cliente de Python solo necesita una URL base diferente. Este ejemplo usa Terra, el nivel equilibrado:
from openai import OpenAI
client = OpenAI(
api_key="YOUR_REAPI_KEY",
base_url="https://api.reapi.ai/v1",
)
response = client.chat.completions.create(
model="gpt-5.6-terra",
messages=[
{"role": "user", "content": "Review this pull request for data-loss risks."}
],
)
print(response.choices[0].message.content)Los IDs de modelo disponibles son:
gpt-5.4gpt-5.5gpt-5.6-solgpt-5.6-terragpt-5.6-luna
No reemplaces los puntos con guiones en las solicitudes de API. El sitio web de reAPI usa slugs de página con guiones, pero los IDs de modelo de conexión preservan los números de versión con puntos de OpenAI.
Una lista de verificación de migración segura
Mover una ruta de API es simple; probar que la nueva ruta es económica requiere un poco más de trabajo.
- Exporta una muestra representativa. Incluye solicitudes cortas y largas, llamadas de herramientas, salida estructurada y casos de fallo conocidos.
- Fija el ID del modelo. No compares el cambio de alias si necesitas un resultado estable antes y después.
- Ejecuta ambas rutas. Mide calidad de respuesta, latencia del primer token, latencia total, tokens de entrada, tokens de salida, reintentos y errores.
- Calcula el costo por resultado aceptado. El precio de token solo oculta reintentos y revisión humana.
- Inspecciona compatibilidad de características. Valida herramientas, salidas estructuradas, streaming e entrada de imagen utilizados por la aplicación.
- Mueve tráfico gradualmente. Comienza con un porcentaje pequeño y mantén la ruta antigua disponible hasta que las tasas de error y facturas coincidan con la prueba.
- Verifica la tarjeta de tarifas activa. La fijación de precios puede cambiar después de que se publique un artículo; trata la página del modelo y la tarjeta de tarifas de API como la fuente de verdad.
Preguntas frecuentes
¿OpenAI bajó los precios de la API de GPT?
No en los cinco modelos en esta comparación. Los precios de lista públicos actuales de OpenAI siguen siendo $2.50/$15 para GPT-5.4, $5/$30 para GPT-5.5 y GPT-5.6 Sol, $2.50/$15 para GPT-5.6 Terra y $1/$6 para GPT-5.6 Luna, por millón de tokens de entrada y salida. La reducción del 20% descrita aquí es la tarifa reAPI actual relativa a esos precios estándar.[1][2]
¿Qué modelos GPT son 20% más baratos en reAPI?
GPT-5.4, GPT-5.5, GPT-5.6 Sol, GPT-5.6 Terra y GPT-5.6 Luna. El descuento se aplica a las tarifas de token de entrada y salida publicadas en las rutas predeterminadas de reAPI.[3]
¿Cuál es el modelo API de GPT-5.6 más barato?
GPT-5.6 Luna. Cuesta $1 entrada y $6 salida por millón de tokens a la tarifa estándar de OpenAI, o $0.80 entrada y $4.80 salida en la ruta predeterminada actual de reAPI.[3][4]
¿Es GPT-5.6 Terra más barato que GPT-5.4?
No. Tienen los mismos precios de token en esta comparación: $2/$12 en reAPI y $2.50/$15 en OpenAI. Terra es más nuevo, pero el mejor valor depende del éxito de tareas, eficiencia de tokens y riesgo de migración.
¿Es GPT-5.6 Sol más barato que GPT-5.5?
No. Ambos son $4/$24 por millón de tokens de entrada/salida en reAPI y $5/$30 a la tarifa estándar de OpenAI. Sol ofrece el nivel de capacidad más nuevo al mismo precio por token.[1]
¿ofrece reAPI entrada en caché con descuento?
La tarjeta de tarifas pública actual no publica una proporción de entrada en caché separada para estas rutas predeterminadas con descuento. No asumas una. Compara una carga de trabajo en caché real y verifica la facturación activa antes de migrar.
¿Puedo seguir usando el SDK de Python de OpenAI?
Sí. Establece base_url a https://api.reapi.ai/v1, usa una clave de reAPI y
mantén el ID de modelo GPT con puntos canónico.
El corte de precios es útil; el costo por resultado es la decisión
Una reducción uniforme del 20% es inusualmente fácil de presupuestar. Mantén la carga de trabajo y modelo fijos, y una factura de token estándar de $1,000 se convierte en aproximadamente $800. La oportunidad más valiosa es el enrutamiento de modelos: Luna para volumen rutinario, Terra para el predeterminado equilibrado y Sol solo donde la capacidad de frontera mejora la tasa de éxito lo suficiente para pagarse por sí sola.
El titular honesto es, por lo tanto, más estrecho que "OpenAI redujo precios" y más útil para los desarrolladores: cinco modelos GPT actuales ahora se ejecutan al 80% de las tarifas de token estándar de OpenAI en reAPI. Verifica tu patrón de caché, uso de contexto largo y opciones asincrónicas, luego mide el costo por resultado aceptado antes de mover tráfico de producción.
Referencias
- OpenAI. GPT-5.6: Frontier intelligence that scales with your ambition. Pricing and tier details. openai.com/index/gpt-5-6
- OpenAI. Introducing GPT-5.5. API pricing and processing options. openai.com/index/introducing-gpt-5-5
- reAPI. Live public API pricing. Retrieved August 1, 2026. api.reapi.ai/api/pricing
- OpenAI. GPT-5.6 Luna model. Specifications, pricing, caching, and long-context rules. developers.openai.com/api/docs/models/gpt-5.6-luna
- OpenAI. API pricing. Standard and Batch processing rates. openai.com/api/pricing
- OpenAI. GPT-5.4 model. Pricing and long-context rules. developers.openai.com/api/docs/models/gpt-5.4
Lectura adicional
- reAPI. How to use GPT-5.6. reapi.ai/blog/how-to-use-gpt-5-6
- reAPI. How to use GPT-5.5. reapi.ai/blog/how-to-use-gpt-5-5
- reAPI. GPT-5.6 model catalog. reapi.ai/models
Autor

Categorías
Más publicaciones

Mejores alternativas a WaveSpeed en 2026: 5 opciones comparadas
¿Buscas una alternativa a WaveSpeed? Compara fal.ai, Replicate, Together AI, RunPod y reAPI por catálogo, precios, velocidad y diseño de API.


DeepSeek V4 Flash Oficial: Mejoras en Agentes y Codex 0731
DeepSeek V4 Flash 0731 en beta pública con benchmarks de agentes mejorados, soporte nativo de API de Respuestas, Codex y el mismo ID de modelo.


Imágenes de personajes 3D consistentes con API por $0.143
Crea un flujo de personaje 3D consistente con Wan 2.7: genera un maestro y cinco escenas por $0.143 y calcula el coste real por imagen aceptada.
