
GPT-6 Sol 价格:API 定价、token 费用与缓存费率
GPT-6 Sol 每百万 token 价格:输入、输出、缓存读取与写入、272K 长上下文规则,以及 Batch、Flex 和 Fast 模式,并附带算例。
在 OpenAI API 上,GPT-6 Sol 的价格起步是每百万输入 token $2、每百万输出 token $10,适用于输入不超过 272K token 的提示[1]。这两个数字只是账单的一部分。OpenAI 还对缓存输入和缓存写入单独计价,提示超过 272K token 时输入单价翻倍,并且 Batch、Flex 和 Fast 模式各按不同倍数收费[2]。
本文列出截至 2026 年 10 月 7 日 OpenAI 为 GPT-6 Sol 公布的全部费率,给出四个写明假设的算例,并回答一个经常和它一起被搜索的问题:现在的价格是不是促销价。
要点速览
- 标准费率: 每百万 token 输入 $2、缓存输入 $0.20、缓存写入 $2.50、输出 $10,适用于输入不超过 272K token 的提示[1]。
- 长提示: 输入超过 272K token 时,整个请求改按输入 $4、缓存 $0.40、缓存写入 $5、输出 $15 计费[1][2]。
- 推理 token 按输出计费。 你选择的 effort 档位会改变输出 token 数,费用也随之变化[3]。
- 处理档位: Batch 和 Flex 为 Standard 的 50%,Fast 模式为 2 倍,区域处理加收 10%[2]。
- 未找到促销: OpenAI 页面上的促销价属于 GPT-5.6 Sol,不属于 GPT-6 Sol[1][4]。
- 在 reAPI 上: 按 token 计费,同样分这四个维度,费率见 GPT-6 Sol 模型页。
GPT-6 Sol 每百万 token 价格
OpenAI 的价格页把每项费率分成短上下文一列(输入不超过 272K token)和长上下文一列(超过 272K)[1]:
| GPT-6 Sol,Standard,每 1M token | 输入不超过 272K | 输入超过 272K |
|---|---|---|
| 输入 | $2.00 | $4.00 |
| 缓存输入 | $0.20 | $0.40 |
| 缓存写入 | $2.50 | $5.00 |
| 输出 | $10.00 | $15.00 |
模型页解释了这些比例:缓存输入是未缓存输入单价的 10%,缓存写入是它的 1.25 倍,超过 272K 的提示“输入和缓存按 2 倍、输出按 1.5 倍计价,适用于整个请求”[2]。关键在“整个请求”这几个字:一旦越过阈值,请求里的每个 token 都会重新定价,而不只是超出 272K 的那部分。
单个请求的费用上限由两个限制框定。GPT-6 Sol 在 1,050,000 token 的上下文窗口内,最多接受 922,000 个输入 token,最多返回 128,000 个输出 token[2]。
哪些因素会改变 GPT-6 Sol 的账单
推理 token。 GPT-6 Sol 是推理模型。OpenAI 的推理指南说明,推理 token 在 API 中不可见,但“按输出 token 计费”[3]。effort 档位从 none 到 max,默认 medium[2],所以即使不设置 effort,请求也会按 $10 的输出单价为一轮推理付费。
缓存。 对 GPT-5.6 及之后的模型,OpenAI 按输入单价的 1.25 倍收取缓存写入,按 0.1 倍收取缓存读取。缓存的前缀在最近一次写入或复用之后至少保留 30 分钟,可缓存前缀最少 1,024 个输入 token[5]。缓存写入是替代这些 token 的普通输入单价,而不是在其上叠加[5]。实际效果是:一个前缀写入一次、再复用一次,花费是不缓存时价格的 1.35 倍,而不缓存处理两次是 2 倍[5]。
处理档位。 同样的 token,发送方式不同,价格也不同[1]:
| GPT-6 Sol,每 1M token,不超过 272K | 输入 | 缓存输入 | 缓存写入 | 输出 |
|---|---|---|---|---|
| Standard | $2.00 | $0.20 | $2.50 | $10.00 |
| Batch | $1.00 | $0.10 | $1.25 | $5.00 |
| Flex | $1.00 | $0.10 | $1.25 | $5.00 |
| Fast 模式 | $4.00 | $0.40 | $5.00 | $20.00 |
Flex 按 Batch 费率计价,代价是响应更慢、偶尔资源不可用,OpenAI 将其标为 beta[6]。区域处理(数据驻留)在可用地区加收 10%,GPT-6 Sol 的 Fast 模式不能与欧盟数据驻留同时使用[2][7]。
GPT-6 Sol 费用算例
四个算例都使用上面的 OpenAI 刊例价。它们是写明假设的示意,不是真实流量的测量。你的提示 token 数会不同,输出 token 数包含推理 token。
算例 A:一次对话请求。 2,000 个输入 token、800 个输出 token,Standard,无缓存。 输入 2,000 × $2 / 1M = $0.004,输出 800 × $10 / 1M = $0.008,每个请求 $0.012,即每 1,000 个请求 $12。
算例 B:带缓存的共享前缀。 40 个请求复用同一段 50,000 token 的指令和参考资料,每个请求另加 2,000 个新输入 token,返回 1,000 个输出 token。假设在共享段之后设置一个显式缓存断点,且 40 个请求都在缓存有效期内。断点之后的新输入按普通输入单价计费,不收写入费[5]。
| 项目 | 计算 | 费用 |
|---|---|---|
| 首次缓存写入 | 50,000 × $2.50 / 1M | $0.125 |
| 39 次缓存读取 | 39 × 50,000 × $0.20 / 1M | $0.390 |
| 新输入 | 40 × 2,000 × $2 / 1M | $0.160 |
| 输出 | 40 × 1,000 × $10 / 1M | $0.400 |
| 使用缓存合计 | $1.075 | |
| 不使用缓存合计 | 40 × 52,000 × $2 / 1M + $0.40 | $4.56 |
在这个场景里,缓存让账单减少约四分之三,因为每个提示的大部分都是重复的那一段。
算例 C:越过 272K。 一个请求有 300,000 个输入 token、5,000 个输出 token,会改按长上下文费率:300,000 × $4 / 1M = $1.20,加上 5,000 × $15 / 1M = $0.075,共 $1.275。把同一请求的输入裁到 270,000 token,费用是 270,000 × $2 / 1M = $0.54 加上 5,000 × $10 / 1M = $0.05,共 $0.59。输入少 10%,费用降到一半以下,所以在发送整个代码库或整批文档之前,先检查提示长度。
算例 D:同一任务在各档位的费用。 算例 A 运行 10,000 次,Standard 为 $120,Batch 或 Flex 为 $60,Fast 模式为 $240(每个请求 2,000 × $4 / 1M + 800 × $20 / 1M = $0.024)。
估算自己的用量时,把每类 token 乘以对应费率:未缓存输入 × 输入单价,缓存读取 × 缓存单价,缓存写入 × 写入单价,输出(含推理)× 输出单价。只要有单个请求超过 272K 输入 token,该请求就用长上下文一列。
GPT-6 Sol 是促销价吗?
我们没有找到任何表明它是促销价的说明。OpenAI 价格页上只有一条促销说明:“GPT-5.6 Sol 的促销价至少持续到 2026 年 11 月 21 日”[1]。GPT-6 Sol 模型页、9 月 22 日宣布 GPT-6 Sol 输入 $2、输出 $10 的 changelog 条目,以及发布文章,都没有为 GPT-6 Sol 标注促销或结束日期[2][4][8]。发布文章中“promotional”一词只用来描述 GPT-6 Sol 的比较对象:Sol 和 Luna 的价格“相比 GPT‑5.6 的促销价降低 50%”[8]。
如果 OpenAI 以后给 GPT-6 Sol 的价格加上期限,最可能出现在本文引用的同一个价格页和 changelog 上。
GPT-6 Sol 与其他 OpenAI 模型的价格对比
OpenAI 价格页上的 Standard 短上下文费率,每百万 token[1]:
| 模型 | 输入 | 缓存输入 | 缓存写入 | 输出 |
|---|---|---|---|---|
| GPT-6 Astra | $10.00 | $1.00 | $12.50 | $50.00 |
| GPT-6.1 Sol | $2.00 | $0.10 | $2.50 | $10.00 |
| GPT-6 Sol | $2.00 | $0.20 | $2.50 | $10.00 |
| GPT-6 Luna | $0.10 | $0.01 | $0.125 | $0.50 |
| GPT-5.6 Sol | $4.00 | $0.40 | $5.00 | $20.00 |
GPT-6.1 Sol 于 2026 年 9 月 29 日发布,输入、输出和缓存写入费率与 GPT-6 Sol 相同,但缓存输入只有一半,是输入单价的 5% 而不是 10%[4][5]。对大量使用缓存的 agent 循环,这个差距会累积起来,不过 GPT-6.1 Sol 也去掉了 none effort,并且在 Chat Completions 上不支持工具调用[9]。迁移相关内容见我们的 GPT-6 Sol vs 5.6 Sol 对比。
GPT-6 Sol 在 reAPI 上的价格
reAPI 通过 Chat Completions 接口提供 GPT-6 Sol,模型 ID 为 gpt-6-sol,按 token 从你的 reAPI 余额扣费。计费维度与 OpenAI 一致:输入、输出、缓存读取和缓存写入各有费率,推理 token 按输出计费,输入超过 272K token 的提示整个请求改按长上下文费率计价[10]。reAPI 文档说明每一项费率都低于 OpenAI 公布的每 token 价格[10]。当前数字和费用估算器见 GPT-6 Sol 模型页。
常见问题
GPT-6 Sol 促销价会持续多久?
我们在 OpenAI 的价格页、模型页、changelog 和发布文章中都没有找到 GPT-6 Sol 的促销期[1][2][4][8]。OpenAI 写明的促销属于 GPT-5.6 Sol:输入 $4、输出 $20,至少持续到 2026 年 11 月 21 日[1]。
ChatGPT 6 要多少钱?
在 API 中,GPT-6 Sol 的 Standard 价格是每百万输入 token $2、每百万输出 token $10。GPT-6 Astra 为 $10 和 $50,GPT-6 Luna 为 $0.10 和 $0.50[1]。在 ChatGPT 中,GPT-6 Sol 提供给 Plus、Pro、Business、Enterprise 和 Edu 套餐的 ChatGPT Work 和 Codex[8];套餐价格不在本文范围内。
GPT-6 Sol Fast 模式价格
GPT-6 Sol 的 Fast 模式是 Standard 的 2 倍:不超过 272K 时每百万 token 输入 $4、缓存输入 $0.40、缓存写入 $5、输出 $20,超过 272K 时为 $8、$0.80、$10 和 $30[1][2]。
GPT-6 Sol 每个 token 多少钱?
按 Standard 短上下文费率,GPT-6 Sol 每个输入 token $0.000002,每个输出 token $0.00001,即每百万 $2 和 $10[1]。缓存输入 token 的单价是输入的十分之一[2]。
GPT-6 Sol 价格计算器
把每类 token 乘以费率再相加:输入 × $2,缓存输入 × $0.20,缓存写入 × $2.50,输出 × $10,均按每百万 token 计。单个请求超过 272K 输入 token 时,改用 $4、$0.40、$5 和 $15[1]。GPT-6 Sol 模型页 提供按 reAPI 费率计算的估算器。
GPT-5.6 Sol 与 GPT-6 Sol 价格对比
GPT-6 Sol 每一项都是 GPT-5.6 Sol 的一半:输入 $2 对 $4,输出 $10 对 $20,缓存输入 $0.20 对 $0.40,缓存写入 $2.50 对 $5[1]。GPT-5.6 Sol 的 $4 和 $20 是促销价,至少持续到 2026 年 11 月 21 日[1]。
GPT API 要多少钱?
取决于模型。在 OpenAI 当前价格页上,GPT-6 系列的 Standard 输入单价从 GPT-6 Luna 的每百万 token $0.10 到 GPT-6 Astra 的 $10 不等,每个模型的输出单价都高于输入[1]。
为 GPT-6 Sol 做预算
对大多数工作负载,第一个杠杆是输出 token 数,因为输出单价是输入的五倍,而且包含推理。选择能通过你质量检查的最低 effort。第二个杠杆是缓存反复发送的指令或文档;在算例 B 中它让费用减少约四分之三。第三个是让每个请求的输入保持在 272K token 以内。如果结果可以等,Batch 能把账单减半。GPT-6 Sol 在 OpenAI 的刊例价是每百万输入 token $2、输出 $10,未公布任何促销结束日期;reAPI 当前的每 token 费率见 GPT-6 Sol 模型页。
参考资料
- OpenAI. API pricing. 2026 年 10 月获取自 developers.openai.com/api/docs/pricing
- OpenAI. GPT-6 Sol model page. 2026 年 10 月获取自 developers.openai.com/api/docs/models/gpt-6-sol
- OpenAI. Reasoning models. 2026 年 10 月获取自 developers.openai.com/api/docs/guides/reasoning
- OpenAI. API changelog. 2026 年 10 月获取自 developers.openai.com/api/docs/changelog
- OpenAI. Prompt caching. 2026 年 10 月获取自 developers.openai.com/api/docs/guides/prompt-caching
- OpenAI. Flex processing. 2026 年 10 月获取自 developers.openai.com/api/docs/guides/flex-processing
- OpenAI. Fast mode. 2026 年 10 月获取自 developers.openai.com/api/docs/guides/fast-mode
- OpenAI. Introducing GPT-6 Sol and Luna. 2026 年 10 月获取自 openai.com/index/introducing-gpt-6-sol-and-luna
- OpenAI. GPT-6.1 Sol model page. 2026 年 10 月获取自 developers.openai.com/api/docs/models/gpt-6.1-sol
- reAPI. GPT-6 Sol API docs. 2026 年 10 月获取自 reapi.ai/docs/gpt-6-sol
更多文章

真人 AI 视频生成器:哪些做法真的可行
用真人素材制作 AI 视频:如何准备合规参考图、挑选支持原生对白的模型,并逐项核对输入限制、审核结果与实际生成成本。


Wan 3.0 ComfyUI 使用指南:官方模板、API 接入、账号配置与视频生成费用和输入限制说明
了解 Wan 3.0 ComfyUI 官方模板和自定义 reAPI 接入流程,区分云端生成与本地推理。本文说明账号与积分要求、公开媒体链接、请求字段、任务轮询和结果下载,并根据 2026 年 9 月 14 日核查的资料解释分辨率限制、参考视频计费及自动时长费用,帮助你选择适合现有工作流的接入方式并估算实际请求成本。


2026 年最佳 Replicate 替代方案:5 个选择对比
正在寻找 2026 年的 Replicate 替代方案?从模型范围、价格、速度和 API 设计对比 fal.ai、Together AI、RunPod、Hugging Face 与 reAPI。
