GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
Gemini 4 Argon 价格:首发价、标准价与实际成本
2026/10/01

Gemini 4 Argon 价格:首发价、标准价与实际成本

Gemini 4 Argon 价格详解:$2/$10 首发优惠价、$4/$20 标准价、缓存输入,以及真实任务的费用与 GPT-6 Astra、Opus 5.5 的对比。

Gemini 4 Argon 的价格有两个数字,而大多数报道只提了第一个。谷歌以首发优惠价推出该模型:每百万输入 token $2,每百万输出 token $10,缓存输入比普通输入便宜 95%[1]。同一份公告里的脚注写道:“优惠期结束后,将适用每 1M 输入 token $4、每 1M 输出 token $20 的价格”[1]。谷歌没有说明优惠期持续多久。

所以,任何基于 Gemini 4 Argon 的预算都应该同时按两套价格来算。本文列出完整价目表,用四种真实任务形态算一遍账,并与谷歌自家基准表中三个模型里的两个做费用对比:GPT-6 Astra 和 Claude Opus 5.5。

要点速览

  • 首发优惠价:每 1M 输入 token $2,每 1M 输出 token $10;缓存输入在输入价基础上便宜 95%,即每 1M $0.10[1]。
  • 优惠期后的标准价:每 1M token 输入 $4、输出 $20。谷歌没有公布这一阶段的缓存输入价格[1]。
  • 对比 GPT-6 Astra:Astra 标价为每 1M token 输入 $10、输出 $50,输入超过 272K token 后价格更高[2]。Argon 的首发价只有它的五分之一。
  • 对比 Claude Opus 5.5:Opus 5.5 标价为输入 $4、输出 $20[3],与 Argon 的标准价完全相同。
  • 没有免费额度,开发者也还用不上:第一批开发者是“付费 API 客户”,谷歌没有给出日期[1]。

Gemini 4 Argon 完整价目表

谷歌公布的 Gemini 4 Argon 价格信息,一张表就能装下。标注“未公布”的格子表示谷歌没有说明,而不是零。

项目首发优惠价标准价(优惠期后)
输入,每 1M token$2.00$4.00
输出,每 1M token$10.00$20.00
缓存输入,每 1M token$0.10(比输入便宜 95%)未公布
长上下文附加费未公布未公布
Batch 折扣未公布未公布
优惠期时长未公布

来源:谷歌的公告及其脚注[1]。

有两点值得注意。第一,输出价格是输入的五倍,与 GPT-6 Astra 和 Claude Opus 5.5 的比例相同[2][3]。第二,缓存折扣力度很大。按每百万 $0.10 计算,智能体每一轮都重读一个已缓存的大型代码库,成本只有重新读取的二十分之一。

Gemini 4 Argon 上 100 万 token 要多少钱?

取决于 token 的方向。100 万输入 token 在首发价下是 $2,之后是 $4。100 万输出 token 在首发价下是 $10,之后是 $20[1]。

对 Argon 来说,输出这一项比其他模型更重要,因为 Argon 真的能在一次回答里生成 100 万 token。谷歌把输出上限从 64K 提高到了 1M token[1]。GPT-6 Astra 的输出上限是 128,000 token[2];Claude Opus 5.5 在标准同步 API 上是 128K,通过带 beta header 的 Batch API 可达 300K[4]。因此,一次满长度的 Argon 回答,仅输出部分在首发价下就要 $10,在标准价下要 $20。

真实任务要花多少钱:Argon vs GPT-6 Astra vs Claude Opus 5.5

标价掩盖了任务本身的形态,所以下面用四种任务形态把账算出来。所有数字都按各厂商公布的单次请求标准 API 标价计算,不含 Batch 折扣。Astra 的提示超过 272K 输入 token 后,输入价翻倍、输出价升至 1.5 倍[2],触发该规则的地方已按此计算。

任务Argon 首发价Argon 标准价Claude Opus 5.5GPT-6 Astra
代码审查:输入 100K,输出 20K$0.40$0.80$0.80$2.00
智能体单轮:100K 新输入 + 400K 缓存输入,输出 50K$0.74未公布$1.48$6.55
长篇报告:输入 200K,输出 600K$6.40$12.80无法在一次回答中完成无法在一次回答中完成
最大输出:输入 100K,输出 1M$10.20$20.40无法在一次回答中完成无法在一次回答中完成

智能体那一行的算法:Argon 首发价为 100K × $2 + 400K × $0.10 + 50K × $10(均按每百万计)。Opus 5.5 使用其 $0.20 的缓存命中价[3]。Astra 的 500K token 提示超过了 272K,因此输入变为每百万 $20、缓存输入 $2、输出 $75[2]。表中没有计入写入缓存的一次性费用,各家都另行收取。

规律很简单。在首发价下,Gemini 4 Argon 处理普通请求的费用是 Claude Opus 5.5 的一半、GPT-6 Astra 的五分之一。优惠期结束后,Argon 与 Opus 5.5 的 token 单价相同,Astra 的价格仍是它们的 2.5 倍。最后两行根本不是价格对比:只有 Argon 能在一次调用里返回这么多文本。

首发优惠价什么时候结束

谷歌只说 $4 和 $20 的价格在“优惠期结束后”适用[1]。没有日期,而开发者 API 也还没开放,所以有可能在大多数开发者能发出请求之前,优惠期就已经过去了一部分。

请按标准价做规划。如果一项任务只有在 $2 和 $10 的价格下才划算,那它会在一个没人公布过的日期失效。如果它在 $4 和 $20 下也成立,优惠期就是额外的折扣。

1M token 输出预算在实践中意味着什么

长输出是 Gemini 4 Argon 定价最有意思的地方,也是最可能让你意外的地方。谷歌称 Argon 能“在单条轨迹中生成数十万 token”[1]。正是这个特性,让 Argon 智能体重写了 libgav1 中 32K 行 SIMD 代码,并参与了一个 800K+ 行的内核迁移[1]。

这也意味着,一个无人看管的请求在标准价下可能花掉 $20。三个习惯可以把它控制住:

  1. 每个请求都设置最大输出预算。把 1M 上限当作余量,而不是默认值。
  2. 缓存稳定的上下文。每一轮都要重读的代码仓库或文档集,应该按每百万 $0.10 放在缓存里,而不是按 $2 作为新输入。
  3. 按任务衡量输出,而不是按 token。一个靠一次长回答完成任务的模型,即使 token 单价更高,也可能比需要五次较短重试的模型更省钱。

reAPI 的定位

Gemini 4 Argon 目前还没有在 reAPI 上线,因为谷歌尚未开放开发者访问[1]。它在 reAPI 上线时,我们会在 Gemini 4 Argon 模型页公布 reAPI 价格。

如果你想现在就开始开发,Claude Opus 5.5 已在 reAPI 上线,它在 Anthropic 官方平台的 token 标价与 Argon 的标准价相同[3]。reAPI 当前价格见各模型页。想了解输出上限为什么会影响成本,可以看我们的 LLM 最大输出 token 指南。

常见问题

Gemini 4 Argon 多少钱?

首发时为每 1M 输入 token $2、每 1M 输出 token $10,缓存输入每 1M $0.10。优惠期结束后,为每 1M token 输入 $4、输出 $20[1]。

Gemini 4 Argon 免费吗?

不免费。谷歌只公布了付费价格,第一批开发者访问也会给付费 API 客户[1]。

Gemini 4 Argon 的首发优惠价持续多久?

谷歌没有说明。公告只表示,优惠期结束后适用标准价[1]。

Gemini 4 Argon 比 GPT-6 Astra 便宜吗?

按标价是的。Astra 每 1M token 输入 $10、输出 $50[2],是 Argon 首发价的五倍、标准价的 2.5 倍。

Gemini 4 Argon 比 Claude Opus 5.5 便宜吗?

优惠期内是的,便宜一半。优惠期后,两者标价都是每 1M token 输入 $4、输出 $20[1][3]。

使用 Gemini 4 Argon 需要 Google AI Ultra 订阅吗?

API 不需要,API 按 token 计费。Google AI Ultra 是谷歌点名的、首批面向普通用户开放的消费者套餐[1]。

如何估算 Gemini 4 Argon 的账单?

输入 token 乘以输入单价,缓存输入 token 乘以缓存单价,输出 token 乘以输出单价,均按每百万计。然后再按标准价算一遍,因为优惠期没有公布结束日期。

为 Gemini 4 Argon 做预算

头条数字是真的:按 $2 和 $10 计算,Gemini 4 Argon 比谷歌自家对比表里的所有模型都便宜。但这是一个大多数开发者还调用不了的模型上的促销价,而且结束日期没人公布。请把业务测算建立在 $4 和 $20 上,这让 Argon 与 Claude Opus 5.5 持平、远低于 GPT-6 Astra,再把优惠期当作额外收益。

更大的定价看点是输出长度。在这组对比里,没有其他模型能在一次回答中向你收取一百万输出 token 的费用。所以 Gemini 4 Argon 的价格恰恰在它最强的地方最便宜,而在一次长运行无人看管时最贵。

参考资料

  1. Google. Gemini 4 Argon: our next era of frontier intelligence. 2026 年 10 月检索自 blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon
  2. OpenAI. GPT-6 Astra model page. 2026 年 10 月检索自 developers.openai.com/api/docs/models/gpt-6-astra
  3. Anthropic. Pricing. 2026 年 10 月检索自 platform.claude.com/docs/en/about-claude/pricing
  4. Anthropic. Models overview. 2026 年 10 月检索自 platform.claude.com/docs/en/about-claude/models/overview