
Precio de Gemini 4 Argon: tarifa introductoria y coste real
El precio de Gemini 4 Argon explicado: tarifa introductoria de $2/$10, tarifa estándar de $4/$20, entrada en caché y coste real frente a GPT-6 Astra y Opus 5.5.
El precio de Gemini 4 Argon tiene dos cifras, y la mayoría de las noticias solo citan la primera. Google lanzó el modelo con un precio introductorio de $2 por millón de tokens de entrada y $10 por millón de tokens de salida, con la entrada en caché un 95 % más barata que la entrada normal[1]. Una nota al pie del mismo anuncio dice que "cuando termine el periodo introductorio, se aplicará el precio de $4 por 1M tokens de entrada y $20 por 1M tokens de salida"[1]. Google no dijo cuánto dura el periodo introductorio.
Así que cualquier presupuesto basado en Gemini 4 Argon debería contemplar las dos tarifas. Este artículo presenta la tabla de precios completa, calcula cuatro tipos de tareas reales y compara la factura con dos de los tres modelos de la propia tabla de benchmarks de Google: GPT-6 Astra y Claude Opus 5.5.
TL;DR
- Tarifa introductoria: $2 por 1M tokens de entrada, $10 por 1M tokens de salida, y entrada en caché con un 95 % de descuento sobre el precio de entrada, es decir, $0.10 por 1M[1].
- Tarifa estándar tras el periodo introductorio: $4 de entrada y $20 de salida por 1M tokens. Google no ha publicado la tarifa de entrada en caché para esta fase[1].
- Frente a GPT-6 Astra: Astra cuesta $10 de entrada y $50 de salida por 1M tokens, con tarifas más altas por encima de 272K tokens de entrada[2]. La tarifa introductoria de Argon es una quinta parte.
- Frente a Claude Opus 5.5: Opus 5.5 cuesta $4 de entrada y $20 de salida[3], exactamente la tarifa estándar de Argon.
- Sin nivel gratuito y todavía sin acceso para desarrolladores: la primera oleada de desarrolladores son "clientes de pago de la API", y Google no ha dado fecha[1].
La tabla de precios completa de Gemini 4 Argon
Todo lo que Google ha publicado sobre el precio de Gemini 4 Argon cabe en una tabla. Las celdas marcadas como "No publicado" son cosas que Google no ha dicho, no ceros.
| Concepto | Tarifa introductoria | Tarifa estándar (tras la introductoria) |
|---|---|---|
| Entrada, por 1M tokens | $2.00 | $4.00 |
| Salida, por 1M tokens | $10.00 | $20.00 |
| Entrada en caché, por 1M tokens | $0.10 (95 % menos que la entrada) | No publicado |
| Recargo por contexto largo | No publicado | No publicado |
| Descuento por lotes (batch) | No publicado | No publicado |
| Duración del periodo introductorio | No publicado |
Fuentes: el anuncio de Google y su nota al pie[1].
Hay dos cosas que destacan. Primero, la salida cuesta cinco veces más que la entrada, la misma proporción que usan GPT-6 Astra y Claude Opus 5.5[2][3]. Segundo, el descuento por caché es fuerte. A $0.10 por millón, releer una gran base de código en caché en cada turno de un agente cuesta una vigésima parte de leerla de cero.
¿Cuánto cuesta 1 millón de tokens en Gemini 4 Argon?
Depende de la dirección de los tokens. Un millón de tokens de entrada cuesta $2 con la tarifa introductoria y $4 después. Un millón de tokens de salida cuesta $10 con la tarifa introductoria y $20 después[1].
El caso de la salida importa más en Argon que en otros modelos, porque Argon sí puede producir un millón de tokens en una sola respuesta. Google subió el límite de salida a 1M tokens, frente a 64K[1]. GPT-6 Astra se detiene en 128.000 tokens de salida[2], y Claude Opus 5.5 en 128K en su API síncrona estándar, o 300K a través de su Batch API con un header beta[4]. Por tanto, una respuesta de Argon de longitud máxima cuesta $10 solo en salida con la tarifa introductoria, y $20 con la tarifa estándar.
Cuánto cuestan las tareas reales: Argon vs GPT-6 Astra vs Claude Opus 5.5
Los precios de lista ocultan la forma del trabajo, así que aquí van cuatro tipos de tareas con las cuentas hechas. Todas las cifras usan el precio de lista estándar publicado por cada proveedor para una sola petición, sin descuentos por lotes. Las tarifas de Astra se duplican en la entrada y suben 1,5 veces en la salida cuando un prompt supera los 272K tokens de entrada[2], y esa regla se aplica donde corresponde.
| Tarea | Argon introductoria | Argon estándar | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|---|---|
| Revisión de código: 100K de entrada, 20K de salida | $0.40 | $0.80 | $0.80 | $2.00 |
| Turno de agente: 100K nuevos + 400K en caché de entrada, 50K de salida | $0.74 | No publicado | $1.48 | $6.55 |
| Informe largo: 200K de entrada, 600K de salida | $6.40 | $12.80 | No es posible en una respuesta | No es posible en una respuesta |
| Salida máxima: 100K de entrada, 1M de salida | $10.20 | $20.40 | No es posible en una respuesta | No es posible en una respuesta |
Cómo se calcula la fila del agente: Argon introductoria es 100K × $2 + 400K × $0.10 + 50K × $10 por millón. Opus 5.5 usa su tarifa de acierto de caché de $0.20[3]. El prompt de 500K tokens de Astra supera los 272K, así que la entrada pasa a $20, la entrada en caché a $2 y la salida a $75 por millón[2]. La tabla no incluye el coste único de escribir la caché, que todos los proveedores cobran aparte.
El patrón es sencillo. Con la tarifa introductoria, Gemini 4 Argon cuesta la mitad que Claude Opus 5.5 y una quinta parte que GPT-6 Astra en peticiones normales. Tras el periodo introductorio, Argon y Opus 5.5 cuestan lo mismo por token, y Astra sigue costando dos veces y media más. Las dos últimas filas no son una comparación de precios: solo Argon puede devolver tanto texto en una sola llamada.
Cuándo termina la tarifa introductoria
Google solo dice que las tarifas de $4 y $20 se aplican "cuando termine el periodo introductorio"[1]. No hay fecha, y la API para desarrolladores todavía no está abierta, así que es posible que parte del periodo introductorio pase antes de que la mayoría de los desarrolladores puedan hacer una petición.
Planifica con la tarifa estándar. Si una carga de trabajo solo tiene sentido a $2 y $10, es una carga de trabajo que se rompe en una fecha que nadie ha anunciado. Si funciona a $4 y $20, el periodo introductorio es un descuento extra.
Qué significa en la práctica un presupuesto de salida de 1M tokens
Las salidas largas son donde el precio de Gemini 4 Argon se vuelve interesante, y también donde puede darte una sorpresa. Google dice que Argon puede "generar cientos de miles de tokens en una sola trayectoria"[1]. Esa es la capacidad que permitió a los agentes de Argon reescribir 32K líneas de código SIMD en libgav1 y trabajar en una migración de un kernel de más de 800K líneas[1].
También significa que una sola petición sin supervisión puede gastar $20 con la tarifa estándar. Tres hábitos lo mantienen bajo control:
- Fija un presupuesto máximo de salida en cada petición. Trata el límite de 1M como margen, no como valor por defecto.
- Guarda en caché el contexto estable. Un repositorio o conjunto de documentos que se relee en cada turno debería estar en caché a $0.10 por millón, no como entrada nueva a $2.
- Mide la salida por tarea, no por token. Un modelo que termina en una sola respuesta larga puede costar menos que otro que necesita cinco reintentos más cortos, incluso con un precio por token más alto.
Dónde encaja reAPI
Gemini 4 Argon todavía no está disponible en reAPI, porque Google no ha abierto el acceso a desarrolladores[1]. Publicaremos el precio en reAPI en la página del modelo Gemini 4 Argon cuando se lance aquí.
Si quieres empezar a construir ya, Claude Opus 5.5 está disponible en reAPI y, en la plataforma de Anthropic, su precio por token es el mismo que la tarifa estándar de Argon[3]. Las tarifas actuales de reAPI están en la página de cada modelo. Para entender por qué los límites de salida influyen en el coste, consulta nuestra guía sobre los max output tokens de los LLM.
Preguntas frecuentes
¿Cuánto cuesta Gemini 4 Argon?
En el lanzamiento, $2 por 1M tokens de entrada y $10 por 1M tokens de salida, con la entrada en caché a $0.10 por 1M. Tras el periodo introductorio, $4 de entrada y $20 de salida por 1M tokens[1].
¿Gemini 4 Argon es gratis?
No. Google solo ha anunciado precios de pago, y el primer acceso para desarrolladores es para clientes de pago de la API[1].
¿Cuánto dura el precio introductorio de Gemini 4 Argon?
Google no lo ha dicho. El anuncio solo indica que la tarifa estándar se aplica cuando termine el periodo introductorio[1].
¿Gemini 4 Argon es más barato que GPT-6 Astra?
Sí, en precio de lista. Astra cuesta $10 de entrada y $50 de salida por 1M tokens[2], cinco veces la tarifa introductoria de Argon y dos veces y media su tarifa estándar.
¿Gemini 4 Argon es más barato que Claude Opus 5.5?
Durante el periodo introductorio, sí, a la mitad. Después, ambos cuestan $4 de entrada y $20 de salida por 1M tokens[1][3].
¿Gemini 4 Argon necesita una suscripción a Google AI Ultra?
No para la API, que se cobra por token. Google AI Ultra es el plan para consumidores que Google ha nombrado para el primer acceso de consumidores[1].
¿Cómo calculo una factura de Gemini 4 Argon?
Multiplica los tokens de entrada por la tarifa de entrada, los tokens de entrada en caché por la tarifa de caché y los tokens de salida por la tarifa de salida, todo por millón. Después repite las cuentas con la tarifa estándar, ya que el periodo introductorio no tiene fin publicado.
Cómo presupuestar Gemini 4 Argon
El titular es cierto: a $2 y $10, Gemini 4 Argon es más barato que cualquier modelo de la propia tabla comparativa de Google. Pero es un precio promocional para un modelo al que la mayoría de los desarrolladores todavía no puede llamar, con una fecha de fin que nadie ha publicado. Basa el caso de negocio en $4 y $20, que sitúa a Argon al nivel de Claude Opus 5.5 y muy por debajo de GPT-6 Astra, y cuenta el periodo introductorio como ventaja adicional.
La historia de precios más importante es la longitud de salida. Ningún otro modelo de esta comparativa puede cobrarte un millón de tokens de salida en una sola respuesta, así que el precio de Gemini 4 Argon es más barato justo donde también es más capaz, y más caro cuando una ejecución larga se queda sin control.
Referencias
- Google. Gemini 4 Argon: our next era of frontier intelligence. Consultado en octubre de 2026 en blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon
- OpenAI. GPT-6 Astra model page. Consultado en octubre de 2026 en developers.openai.com/api/docs/models/gpt-6-astra
- Anthropic. Pricing. Consultado en octubre de 2026 en platform.claude.com/docs/en/about-claude/pricing
- Anthropic. Models overview. Consultado en octubre de 2026 en platform.claude.com/docs/en/about-claude/models/overview
Autor

Categorías
Más publicaciones

Comparar DeepSeek Harness, OpenCode y Claude Code
Compara DeepSeek Harness, OpenCode y Claude Code según control de entorno, modelos, plugins, permisos, complejidad de instalación y costo de agentes.


API de IA gratis 2026: los límites reales de cada proveedor
Google excluye imágenes, vídeos y música de su API gratuita. Aquí están los límites reales de cada proveedor en 2026, con sus precios oficiales.


Midjourney V8.2: nueve parámetros retirados de V6 y V7
V8.2 eliminó Quality, Turbo y siete características más de V6 y V7. Qué sigue funcionando, qué usa V7 debajo, y cuánto cuesta realmente renderizar en HD.
