GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
GPT-6 Sol 价格:API 定价、token 费用与缓存费率
2026/10/07

GPT-6 Sol 价格:API 定价、token 费用与缓存费率

GPT-6 Sol 每百万 token 价格:输入、输出、缓存读取与写入、272K 长上下文规则,以及 Batch、Flex 和 Fast 模式,并附带算例。

在 OpenAI API 上,GPT-6 Sol 的价格起步是每百万输入 token $2、每百万输出 token $10,适用于输入不超过 272K token 的提示[1]。这两个数字只是账单的一部分。OpenAI 还对缓存输入和缓存写入单独计价,提示超过 272K token 时输入单价翻倍,并且 Batch、Flex 和 Fast 模式各按不同倍数收费[2]。

本文列出截至 2026 年 10 月 7 日 OpenAI 为 GPT-6 Sol 公布的全部费率,给出四个写明假设的算例,并回答一个经常和它一起被搜索的问题:现在的价格是不是促销价。

要点速览

  • 标准费率: 每百万 token 输入 $2、缓存输入 $0.20、缓存写入 $2.50、输出 $10,适用于输入不超过 272K token 的提示[1]。
  • 长提示: 输入超过 272K token 时,整个请求改按输入 $4、缓存 $0.40、缓存写入 $5、输出 $15 计费[1][2]。
  • 推理 token 按输出计费。 你选择的 effort 档位会改变输出 token 数,费用也随之变化[3]。
  • 处理档位: Batch 和 Flex 为 Standard 的 50%,Fast 模式为 2 倍,区域处理加收 10%[2]。
  • 未找到促销: OpenAI 页面上的促销价属于 GPT-5.6 Sol,不属于 GPT-6 Sol[1][4]。
  • 在 reAPI 上: 按 token 计费,同样分这四个维度,费率见 GPT-6 Sol 模型页。

GPT-6 Sol 每百万 token 价格

OpenAI 的价格页把每项费率分成短上下文一列(输入不超过 272K token)和长上下文一列(超过 272K)[1]:

GPT-6 Sol,Standard,每 1M token输入不超过 272K输入超过 272K
输入$2.00$4.00
缓存输入$0.20$0.40
缓存写入$2.50$5.00
输出$10.00$15.00

模型页解释了这些比例:缓存输入是未缓存输入单价的 10%,缓存写入是它的 1.25 倍,超过 272K 的提示“输入和缓存按 2 倍、输出按 1.5 倍计价,适用于整个请求”[2]。关键在“整个请求”这几个字:一旦越过阈值,请求里的每个 token 都会重新定价,而不只是超出 272K 的那部分。

单个请求的费用上限由两个限制框定。GPT-6 Sol 在 1,050,000 token 的上下文窗口内,最多接受 922,000 个输入 token,最多返回 128,000 个输出 token[2]。

哪些因素会改变 GPT-6 Sol 的账单

推理 token。 GPT-6 Sol 是推理模型。OpenAI 的推理指南说明,推理 token 在 API 中不可见,但“按输出 token 计费”[3]。effort 档位从 none 到 max,默认 medium[2],所以即使不设置 effort,请求也会按 $10 的输出单价为一轮推理付费。

缓存。 对 GPT-5.6 及之后的模型,OpenAI 按输入单价的 1.25 倍收取缓存写入,按 0.1 倍收取缓存读取。缓存的前缀在最近一次写入或复用之后至少保留 30 分钟,可缓存前缀最少 1,024 个输入 token[5]。缓存写入是替代这些 token 的普通输入单价,而不是在其上叠加[5]。实际效果是:一个前缀写入一次、再复用一次,花费是不缓存时价格的 1.35 倍,而不缓存处理两次是 2 倍[5]。

处理档位。 同样的 token,发送方式不同,价格也不同[1]:

GPT-6 Sol,每 1M token,不超过 272K输入缓存输入缓存写入输出
Standard$2.00$0.20$2.50$10.00
Batch$1.00$0.10$1.25$5.00
Flex$1.00$0.10$1.25$5.00
Fast 模式$4.00$0.40$5.00$20.00

Flex 按 Batch 费率计价,代价是响应更慢、偶尔资源不可用,OpenAI 将其标为 beta[6]。区域处理(数据驻留)在可用地区加收 10%,GPT-6 Sol 的 Fast 模式不能与欧盟数据驻留同时使用[2][7]。

GPT-6 Sol 费用算例

四个算例都使用上面的 OpenAI 刊例价。它们是写明假设的示意,不是真实流量的测量。你的提示 token 数会不同,输出 token 数包含推理 token。

算例 A:一次对话请求。 2,000 个输入 token、800 个输出 token,Standard,无缓存。 输入 2,000 × $2 / 1M = $0.004,输出 800 × $10 / 1M = $0.008,每个请求 $0.012,即每 1,000 个请求 $12。

算例 B:带缓存的共享前缀。 40 个请求复用同一段 50,000 token 的指令和参考资料,每个请求另加 2,000 个新输入 token,返回 1,000 个输出 token。假设在共享段之后设置一个显式缓存断点,且 40 个请求都在缓存有效期内。断点之后的新输入按普通输入单价计费,不收写入费[5]。

项目计算费用
首次缓存写入50,000 × $2.50 / 1M$0.125
39 次缓存读取39 × 50,000 × $0.20 / 1M$0.390
新输入40 × 2,000 × $2 / 1M$0.160
输出40 × 1,000 × $10 / 1M$0.400
使用缓存合计$1.075
不使用缓存合计40 × 52,000 × $2 / 1M + $0.40$4.56

在这个场景里,缓存让账单减少约四分之三,因为每个提示的大部分都是重复的那一段。

算例 C:越过 272K。 一个请求有 300,000 个输入 token、5,000 个输出 token,会改按长上下文费率:300,000 × $4 / 1M = $1.20,加上 5,000 × $15 / 1M = $0.075,共 $1.275。把同一请求的输入裁到 270,000 token,费用是 270,000 × $2 / 1M = $0.54 加上 5,000 × $10 / 1M = $0.05,共 $0.59。输入少 10%,费用降到一半以下,所以在发送整个代码库或整批文档之前,先检查提示长度。

算例 D:同一任务在各档位的费用。 算例 A 运行 10,000 次,Standard 为 $120,Batch 或 Flex 为 $60,Fast 模式为 $240(每个请求 2,000 × $4 / 1M + 800 × $20 / 1M = $0.024)。

估算自己的用量时,把每类 token 乘以对应费率:未缓存输入 × 输入单价,缓存读取 × 缓存单价,缓存写入 × 写入单价,输出(含推理)× 输出单价。只要有单个请求超过 272K 输入 token,该请求就用长上下文一列。

GPT-6 Sol 是促销价吗?

我们没有找到任何表明它是促销价的说明。OpenAI 价格页上只有一条促销说明:“GPT-5.6 Sol 的促销价至少持续到 2026 年 11 月 21 日”[1]。GPT-6 Sol 模型页、9 月 22 日宣布 GPT-6 Sol 输入 $2、输出 $10 的 changelog 条目,以及发布文章,都没有为 GPT-6 Sol 标注促销或结束日期[2][4][8]。发布文章中“promotional”一词只用来描述 GPT-6 Sol 的比较对象:Sol 和 Luna 的价格“相比 GPT‑5.6 的促销价降低 50%”[8]。

如果 OpenAI 以后给 GPT-6 Sol 的价格加上期限,最可能出现在本文引用的同一个价格页和 changelog 上。

GPT-6 Sol 与其他 OpenAI 模型的价格对比

OpenAI 价格页上的 Standard 短上下文费率,每百万 token[1]:

模型输入缓存输入缓存写入输出
GPT-6 Astra$10.00$1.00$12.50$50.00
GPT-6.1 Sol$2.00$0.10$2.50$10.00
GPT-6 Sol$2.00$0.20$2.50$10.00
GPT-6 Luna$0.10$0.01$0.125$0.50
GPT-5.6 Sol$4.00$0.40$5.00$20.00

GPT-6.1 Sol 于 2026 年 9 月 29 日发布,输入、输出和缓存写入费率与 GPT-6 Sol 相同,但缓存输入只有一半,是输入单价的 5% 而不是 10%[4][5]。对大量使用缓存的 agent 循环,这个差距会累积起来,不过 GPT-6.1 Sol 也去掉了 none effort,并且在 Chat Completions 上不支持工具调用[9]。迁移相关内容见我们的 GPT-6 Sol vs 5.6 Sol 对比。

GPT-6 Sol 在 reAPI 上的价格

reAPI 通过 Chat Completions 接口提供 GPT-6 Sol,模型 ID 为 gpt-6-sol,按 token 从你的 reAPI 余额扣费。计费维度与 OpenAI 一致:输入、输出、缓存读取和缓存写入各有费率,推理 token 按输出计费,输入超过 272K token 的提示整个请求改按长上下文费率计价[10]。reAPI 文档说明每一项费率都低于 OpenAI 公布的每 token 价格[10]。当前数字和费用估算器见 GPT-6 Sol 模型页。

常见问题

GPT-6 Sol 促销价会持续多久?

我们在 OpenAI 的价格页、模型页、changelog 和发布文章中都没有找到 GPT-6 Sol 的促销期[1][2][4][8]。OpenAI 写明的促销属于 GPT-5.6 Sol:输入 $4、输出 $20,至少持续到 2026 年 11 月 21 日[1]。

ChatGPT 6 要多少钱?

在 API 中,GPT-6 Sol 的 Standard 价格是每百万输入 token $2、每百万输出 token $10。GPT-6 Astra 为 $10 和 $50,GPT-6 Luna 为 $0.10 和 $0.50[1]。在 ChatGPT 中,GPT-6 Sol 提供给 Plus、Pro、Business、Enterprise 和 Edu 套餐的 ChatGPT Work 和 Codex[8];套餐价格不在本文范围内。

GPT-6 Sol Fast 模式价格

GPT-6 Sol 的 Fast 模式是 Standard 的 2 倍:不超过 272K 时每百万 token 输入 $4、缓存输入 $0.40、缓存写入 $5、输出 $20,超过 272K 时为 $8、$0.80、$10 和 $30[1][2]。

GPT-6 Sol 每个 token 多少钱?

按 Standard 短上下文费率,GPT-6 Sol 每个输入 token $0.000002,每个输出 token $0.00001,即每百万 $2 和 $10[1]。缓存输入 token 的单价是输入的十分之一[2]。

GPT-6 Sol 价格计算器

把每类 token 乘以费率再相加:输入 × $2,缓存输入 × $0.20,缓存写入 × $2.50,输出 × $10,均按每百万 token 计。单个请求超过 272K 输入 token 时,改用 $4、$0.40、$5 和 $15[1]。GPT-6 Sol 模型页 提供按 reAPI 费率计算的估算器。

GPT-5.6 Sol 与 GPT-6 Sol 价格对比

GPT-6 Sol 每一项都是 GPT-5.6 Sol 的一半:输入 $2 对 $4,输出 $10 对 $20,缓存输入 $0.20 对 $0.40,缓存写入 $2.50 对 $5[1]。GPT-5.6 Sol 的 $4 和 $20 是促销价,至少持续到 2026 年 11 月 21 日[1]。

GPT API 要多少钱?

取决于模型。在 OpenAI 当前价格页上,GPT-6 系列的 Standard 输入单价从 GPT-6 Luna 的每百万 token $0.10 到 GPT-6 Astra 的 $10 不等,每个模型的输出单价都高于输入[1]。

为 GPT-6 Sol 做预算

对大多数工作负载,第一个杠杆是输出 token 数,因为输出单价是输入的五倍,而且包含推理。选择能通过你质量检查的最低 effort。第二个杠杆是缓存反复发送的指令或文档;在算例 B 中它让费用减少约四分之三。第三个是让每个请求的输入保持在 272K token 以内。如果结果可以等,Batch 能把账单减半。GPT-6 Sol 在 OpenAI 的刊例价是每百万输入 token $2、输出 $10,未公布任何促销结束日期;reAPI 当前的每 token 费率见 GPT-6 Sol 模型页。

参考资料

  1. OpenAI. API pricing. 2026 年 10 月获取自 developers.openai.com/api/docs/pricing
  2. OpenAI. GPT-6 Sol model page. 2026 年 10 月获取自 developers.openai.com/api/docs/models/gpt-6-sol
  3. OpenAI. Reasoning models. 2026 年 10 月获取自 developers.openai.com/api/docs/guides/reasoning
  4. OpenAI. API changelog. 2026 年 10 月获取自 developers.openai.com/api/docs/changelog
  5. OpenAI. Prompt caching. 2026 年 10 月获取自 developers.openai.com/api/docs/guides/prompt-caching
  6. OpenAI. Flex processing. 2026 年 10 月获取自 developers.openai.com/api/docs/guides/flex-processing
  7. OpenAI. Fast mode. 2026 年 10 月获取自 developers.openai.com/api/docs/guides/fast-mode
  8. OpenAI. Introducing GPT-6 Sol and Luna. 2026 年 10 月获取自 openai.com/index/introducing-gpt-6-sol-and-luna
  9. OpenAI. GPT-6.1 Sol model page. 2026 年 10 月获取自 developers.openai.com/api/docs/models/gpt-6.1-sol
  10. reAPI. GPT-6 Sol API docs. 2026 年 10 月获取自 reapi.ai/docs/gpt-6-sol