
GPT API 价格下降:五个模型在 reAPI 便宜 20%
五个 GPT 模型在 reAPI 上比 OpenAI 标准价便宜 20%。对比 GPT-5.4、GPT-5.5 和 GPT-5.6 全系价格。
最新的 GPT API 价格下降 容易被误解。OpenAI 并未宣布公开 API 列表价格的全面降价。对 reAPI 用户来说,变化是路由问题:五个现有的 GPT 模型现在的价格比 OpenAI 标准输入和输出 token 费率低 20%。
此次降价涵盖 GPT-5.4、GPT-5.5 和完整的 GPT-5.6 系列——Sol、Terra 和 Luna。无需新的 SDK 或迁移项目。现有的 OpenAI 兼容代码可以通过更改基础 URL,以及必要时更改模型 id,来使用更低的费率。
本指南比较每个费率、计算真实工作负载上的节省,并说明 OpenAI Batch API 或提示词缓存何时仍能改变结论。
概览
- 五个 GPT 模型在 reAPI 上比 OpenAI 标准列表价便宜 20%: GPT-5.4、GPT-5.5、GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6 Luna。
- 这是 reAPI 折扣,不是 OpenAI 全面降价。 OpenAI 当前公开价格保持不变。[1][2]
- 最便宜的路由是 GPT-5.6 Luna,在 reAPI 上每百万 token 输入费用为 $0.80,输出费用为 $4.80。
- Terra 和 GPT-5.4 在 reAPI 上的 token 价格相同:每百万 token 输入 $2,输出 $12。选择前对两者进行基准测试。
- GPT-5.5 和 GPT-5.6 Sol 也共享价格: 在 reAPI 上每百万 token 输入 $4,输出 $24。
- 20% token 折扣会产生 20% 账单减少,当请求混合和 token 使用保持不变时。使用输出 token 较少的模型可以进一步降低每个完成任务的成本。
GPT API 折扣前后价格
下方所有价格均为美元,每 100 万 token。"OpenAI 列表"是指标准处理,不包括 Batch、Flex、Priority、区域处理或协商的企业合约。reAPI 数据来自其 2026 年 8 月 1 日的实时公开费率表。[3]
| 模型 | OpenAI 输入 | reAPI 输入 | OpenAI 输出 | reAPI 输出 | 降幅 |
|---|---|---|---|---|---|
| GPT-5.4 | $2.50 | $2.00 | $15.00 | $12.00 | 20% |
| GPT-5.5 | $5.00 | $4.00 | $30.00 | $24.00 | 20% |
| GPT-5.6 Sol | $5.00 | $4.00 | $30.00 | $24.00 | 20% |
| GPT-5.6 Terra | $2.50 | $2.00 | $15.00 | $12.00 | 20% |
| GPT-5.6 Luna | $1.00 | $0.80 | $6.00 | $4.80 | 20% |
OpenAI 为这些模型公布了单独的缓存输入价格。当前 reAPI 费率表没有公布这些折扣默认路由的单独缓存输入费率,所以本比较不会虚拟计算一个。将重复的提示词前缀作为单独基准,而不是假设相同的 20% 关系。
GPT API 价格下降对真实账单的影响
假设一个代理每月处理 1 亿个输入 token,并生成 2000 万个输出 token。在相同的 token 使用情况下,月度计算为:
monthly cost = input MTok × input rate + output MTok × output rate
| 模型 | OpenAI 标准 | reAPI | 月度节省 |
|---|---|---|---|
| GPT-5.4 | $550 | $440 | $110 |
| GPT-5.5 | $1,100 | $880 | $220 |
| GPT-5.6 Sol | $1,100 | $880 | $220 |
| GPT-5.6 Terra | $550 | $440 | $110 |
| GPT-5.6 Luna | $220 | $176 | $44 |
百分比固定,但美元影响随支出增长。一个团队目前为相同混合的无缓存标准流量每月支付 $10,000,在迁移后会保留约 $2,000,还未考虑模型行为或 token 消耗的任何变化。
最后这个条件很重要。API 成本不仅是每 token 的价格:
cost per successful task
= price per token × tokens per attempt × attempts per success需要两次重试的更便宜模型可能比一次成功的昂贵模型花费更多。更简洁的模型可以通过发出较少可计费的输出 token 来超越表格。OpenAI 表示 GPT-5.6 提高了 token 效率,所以精心评估的迁移可能节省超过标题 20% 的 token 折扣。[1]
你应该使用哪个折扣的 GPT 模型?
表格创建了两个相同价格的对,这使购买决策比简单选择最新模型更有趣。
GPT-5.6 Luna:大容量默认选择
Luna 是此组中价格最低的模型。OpenAI 将其定位为成本敏感、高容量工作,具有 105 万 token 的上下文窗口和 128K 最大输出。它是分类、提取、排名、常规支持和廉价代理子任务的首选候选。[4]
在 reAPI 上,Luna 的输入和输出价格为每百万 token 分别 $0.80 和 $4.80,比 Terra 便宜 60%。用价格差距进行合适的评估,而不是跳过评估:测量任务完成、重试、延迟和总输出 token。
GPT-5.6 Terra 与 GPT-5.4:相同价格,更新层级
两者在 reAPI 上的成本都是每百万 token 输入 $2,输出 $12。Terra 是自然的首次测试,因为 OpenAI 将其描述为平衡的 GPT-5.6 层级,与 GPT-5.5 竞争,但价格更低。[1]
GPT-5.4 在现有生产提示词已针对其验证时仍然有用。相同价格迁移不会自动免费:模型行为、推理默认、缓存行为和输出长度都可能改变。在转移所有流量前进行影子比较。
GPT-5.6 Sol 与 GPT-5.5:同价位的能力
两者在 reAPI 上的成本都是每百万 token 输入 $4,输出 $24。OpenAI 自己的标准列表价格对该对也相同,分别为 $5 和 $30。Sol 是新旗舰,增加了 GPT-5.6 代的更新推理、工具使用和明确的提示词缓存控制,而 GPT-5.5 是已经优化过它的团队的稳定基线。[1][2]
对于新的高复杂度部署,从 Sol 开始评估。仅当回归测试显示其既有行为在你的工作负载上赢时才保留 GPT-5.5。
20% 折扣不是最便宜选择的情况
一个清晰的价格表很有用,但三个计费细节可以扭转狭隘的对比。
Batch 和 Flex 处理
OpenAI 为 GPT-5.4 和 GPT-5.5 提供 Batch 和 Flex 处理,标准费率的 50%,以及支持的 GPT-5.6 请求的 Batch 处理。[2][5]如果工作负载可以等待并且不需要立即响应,请比较那些异步价格与 reAPI 的实时费率,而不是仅比较标准处理。
20% reAPI 折扣最直接相关于同步、标准 API 流量。夜间离线充实工作与实时编码代理有不同的经济学。
提示词缓存
OpenAI 为 GPT-5.6 列出的缓存读取价格为无缓存输入价格的 10%。GPT-5.6 还以无缓存输入费率的 1.25 倍计费明确的缓存写入,所以净结果取决于前缀被重用的频率。[1]
对于重用数百次的长系统提示词,缓存命中率可能比 20% 的普通输入价格削减更重要。单独跟踪无缓存输入、缓存写入 token、缓存读取 token 和输出。
长上下文请求
对于 GPT-5.4 和具有 105 万上下文窗口的 GPT-5.6 模型,OpenAI 对超过 272K 输入 token 的提示词,对整个请求的输入价格为 2 倍,输出为 1.5 倍。[4][6]reAPI 公开费率表显示基础模型比率,而不是完整的长上下文发票示例。如果你的提示词超过该阈值,测试代表性请求并在投影节省前验证计费使用。
如何使用较低的 GPT API 费率
reAPI 暴露了一个 OpenAI 兼容端点,所以 Python 客户端只需要不同的基础 URL。此示例使用 Terra,平衡层级:
from openai import OpenAI
client = OpenAI(
api_key="YOUR_REAPI_KEY",
base_url="https://api.reapi.ai/v1",
)
response = client.chat.completions.create(
model="gpt-5.6-terra",
messages=[
{"role": "user", "content": "Review this pull request for data-loss risks."}
],
)
print(response.choices[0].message.content)可用的模型 id 为:
gpt-5.4gpt-5.5gpt-5.6-solgpt-5.6-terragpt-5.6-luna
在 API 请求中不要用连字符替换点。reAPI 网站使用连字符页面 slug,但 wire 模型 id 保留 OpenAI 的点号版本号。
安全迁移清单
移动 API 路由很简单;证明新路由经济可行需要更多工作。
- 导出代表性样本。 包括短和长提示词、工具调用、结构化输出和已知故障情况。
- 固定模型 id。 如果需要稳定的前后结果,不要比较移动别名。
- 运行两条路由。 测量答案质量、首 token 延迟、总延迟、输入 token、输出 token、重试和错误。
- 计算每个接受结果的成本。 Token 价格仅隐藏重试和人工审查。
- 检查功能兼容性。 验证应用程序使用的工具、结构化输出、流和图像输入。
- 逐步转移流量。 从小百分比开始,并在错误率和账单与测试匹配之前保持旧路由可用。
- 检查实时费率表。 定价可能在发布文章后改变;将模型页面和 API 费率表视为事实来源。
常见问题
OpenAI 降低了 GPT API 价格吗?
在此比较的五个模型中没有。OpenAI 当前公开列表价格保持不变:GPT-5.4 为 $2.50/$15,GPT-5.5 和 GPT-5.6 Sol 为 $5/$30,GPT-5.6 Terra 为 $2.50/$15,GPT-5.6 Luna 为 $1/$6,每百万输入和输出 token。此处描述的 20% 减少是当前 reAPI 费率相对于这些标准价格。[1][2]
哪些 GPT 模型在 reAPI 上便宜 20%?
GPT-5.4、GPT-5.5、GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6 Luna。该折扣适用于 reAPI 默认路由上发布的输入和输出 token 费率。[3]
最便宜的 GPT-5.6 API 模型是什么?
GPT-5.6 Luna。在 OpenAI 的标准费率下每百万 token 成本为 $1 输入和 $6 输出,或在 reAPI 当前默认路由上 $0.80 输入和 $4.80 输出。[3][4]
GPT-5.6 Terra 比 GPT-5.4 便宜吗?
不。在此比较中它们具有相同的 token 价格:reAPI 上为 $2/$12,OpenAI 上为 $2.50/$15。Terra 更新,但最佳价值取决于任务成功、token 效率和迁移风险。
GPT-5.6 Sol 比 GPT-5.5 便宜吗?
不。两者在 reAPI 上都是每百万输入/输出 token $4/$24,在 OpenAI 标准费率上为 $5/$30。Sol 在相同的 token 价格下提供更新的能力层级。[1]
reAPI 提供折扣的缓存输入吗?
当前公开费率表没有为这些折扣默认路由公布单独的缓存输入比率。不要假设一个。比较真实的缓存工作负载并在迁移前检查实时计费。
我可以继续使用 OpenAI Python SDK 吗?
可以。将 base_url 设置为 https://api.reapi.ai/v1,使用 reAPI key,并保留规范的点号 GPT 模型 id。
价格下降很有用;每个结果的成本才是决策因素
统一的 20% 折扣异常容易预算。保持工作负载和模型固定,$1,000 的标准 token 账单变为大约 $800。更有价值的机会是模型路由:Luna 用于常规容量,Terra 用于平衡默认,Sol 仅在前沿能力足以支付自身成本时。
因此,诚实的标题比"OpenAI 降价"更窄,对开发者更有用:五个现有 GPT 模型现在以 reAPI 上 OpenAI 标准 token 费率的 80% 运行。验证你的缓存模式、长上下文使用和异步选项,然后在转移生产流量前测量每个接受结果的成本。
参考资料
- OpenAI. GPT-5.6: Frontier intelligence that scales with your ambition. Pricing and tier details. openai.com/index/gpt-5-6
- OpenAI. Introducing GPT-5.5. API pricing and processing options. openai.com/index/introducing-gpt-5-5
- reAPI. Live public API pricing. Retrieved August 1, 2026. api.reapi.ai/api/pricing
- OpenAI. GPT-5.6 Luna model. Specifications, pricing, caching, and long-context rules. developers.openai.com/api/docs/models/gpt-5.6-luna
- OpenAI. API pricing. Standard and Batch processing rates. openai.com/api/pricing
- OpenAI. GPT-5.4 model. Pricing and long-context rules. developers.openai.com/api/docs/models/gpt-5.4
进一步阅读
- reAPI. How to use GPT-5.6. reapi.ai/blog/how-to-use-gpt-5-6
- reAPI. How to use GPT-5.5. reapi.ai/blog/how-to-use-gpt-5-5
- reAPI. GPT-5.6 model catalog. reapi.ai/models
作者

分类
更多文章

Seedance 2.5 状态:API 接入、价格与当前限制
Seedance 2.5 已上线:reAPI 模型 ID、480p/720p 价格、30 秒输出、参考素材上限与源视频计费规则。


GPT-5.6 已发布:三层架构与迁移指南
GPT-5.6 已发布三层模型:Sol、Terra、Luna。限制访问期间信息混乱,现已全量开放;Terra 以半价提供 GPT-5.5 级编码,最值得迁移。


AI 视频连续性维护:跨片段的状态账本方法
掌握状态账本、边界帧、延续提示词、API 调用、连续性检查和修复规则,在多个 AI 生成的视频片段中保持并维护完整连续性。
