Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
GPT API 价格下降:五个模型在 reAPI 便宜 20%
2026/08/01

GPT API 价格下降:五个模型在 reAPI 便宜 20%

五个 GPT 模型在 reAPI 上比 OpenAI 标准价便宜 20%。对比 GPT-5.4、GPT-5.5 和 GPT-5.6 全系价格。

最新的 GPT API 价格下降 容易被误解。OpenAI 并未宣布公开 API 列表价格的全面降价。对 reAPI 用户来说,变化是路由问题:五个现有的 GPT 模型现在的价格比 OpenAI 标准输入和输出 token 费率低 20%

此次降价涵盖 GPT-5.4、GPT-5.5 和完整的 GPT-5.6 系列——Sol、Terra 和 Luna。无需新的 SDK 或迁移项目。现有的 OpenAI 兼容代码可以通过更改基础 URL,以及必要时更改模型 id,来使用更低的费率。

本指南比较每个费率、计算真实工作负载上的节省,并说明 OpenAI Batch API 或提示词缓存何时仍能改变结论。

概览

  • 五个 GPT 模型在 reAPI 上比 OpenAI 标准列表价便宜 20%: GPT-5.4、GPT-5.5、GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6 Luna。
  • 这是 reAPI 折扣,不是 OpenAI 全面降价。 OpenAI 当前公开价格保持不变。[1][2]
  • 最便宜的路由是 GPT-5.6 Luna,在 reAPI 上每百万 token 输入费用为 $0.80,输出费用为 $4.80。
  • Terra 和 GPT-5.4 在 reAPI 上的 token 价格相同:每百万 token 输入 $2,输出 $12。选择前对两者进行基准测试。
  • GPT-5.5 和 GPT-5.6 Sol 也共享价格: 在 reAPI 上每百万 token 输入 $4,输出 $24。
  • 20% token 折扣会产生 20% 账单减少,当请求混合和 token 使用保持不变时。使用输出 token 较少的模型可以进一步降低每个完成任务的成本。

GPT API 折扣前后价格

下方所有价格均为美元,每 100 万 token。"OpenAI 列表"是指标准处理,不包括 Batch、Flex、Priority、区域处理或协商的企业合约。reAPI 数据来自其 2026 年 8 月 1 日的实时公开费率表。[3]

模型OpenAI 输入reAPI 输入OpenAI 输出reAPI 输出降幅
GPT-5.4$2.50$2.00$15.00$12.0020%
GPT-5.5$5.00$4.00$30.00$24.0020%
GPT-5.6 Sol$5.00$4.00$30.00$24.0020%
GPT-5.6 Terra$2.50$2.00$15.00$12.0020%
GPT-5.6 Luna$1.00$0.80$6.00$4.8020%

OpenAI 为这些模型公布了单独的缓存输入价格。当前 reAPI 费率表没有公布这些折扣默认路由的单独缓存输入费率,所以本比较不会虚拟计算一个。将重复的提示词前缀作为单独基准,而不是假设相同的 20% 关系。

GPT API 价格下降对真实账单的影响

假设一个代理每月处理 1 亿个输入 token,并生成 2000 万个输出 token。在相同的 token 使用情况下,月度计算为:

monthly cost = input MTok × input rate + output MTok × output rate

100 百万输入 token 和 20 百万输出 token 的月度 GPT API 成本对比,显示 OpenAI 标准价格和 reAPI 折扣价格的五个模型对比

模型OpenAI 标准reAPI月度节省
GPT-5.4$550$440$110
GPT-5.5$1,100$880$220
GPT-5.6 Sol$1,100$880$220
GPT-5.6 Terra$550$440$110
GPT-5.6 Luna$220$176$44

百分比固定,但美元影响随支出增长。一个团队目前为相同混合的无缓存标准流量每月支付 $10,000,在迁移后会保留约 $2,000,还未考虑模型行为或 token 消耗的任何变化。

最后这个条件很重要。API 成本不仅是每 token 的价格:

cost per successful task
= price per token × tokens per attempt × attempts per success

需要两次重试的更便宜模型可能比一次成功的昂贵模型花费更多。更简洁的模型可以通过发出较少可计费的输出 token 来超越表格。OpenAI 表示 GPT-5.6 提高了 token 效率,所以精心评估的迁移可能节省超过标题 20% 的 token 折扣。[1]

你应该使用哪个折扣的 GPT 模型?

表格创建了两个相同价格的对,这使购买决策比简单选择最新模型更有趣。

GPT-5.6 Luna:大容量默认选择

Luna 是此组中价格最低的模型。OpenAI 将其定位为成本敏感、高容量工作,具有 105 万 token 的上下文窗口和 128K 最大输出。它是分类、提取、排名、常规支持和廉价代理子任务的首选候选。[4]

在 reAPI 上,Luna 的输入和输出价格为每百万 token 分别 $0.80 和 $4.80,比 Terra 便宜 60%。用价格差距进行合适的评估,而不是跳过评估:测量任务完成、重试、延迟和总输出 token。

GPT-5.6 Terra 与 GPT-5.4:相同价格,更新层级

两者在 reAPI 上的成本都是每百万 token 输入 $2,输出 $12。Terra 是自然的首次测试,因为 OpenAI 将其描述为平衡的 GPT-5.6 层级,与 GPT-5.5 竞争,但价格更低。[1]

GPT-5.4 在现有生产提示词已针对其验证时仍然有用。相同价格迁移不会自动免费:模型行为、推理默认、缓存行为和输出长度都可能改变。在转移所有流量前进行影子比较。

GPT-5.6 Sol 与 GPT-5.5:同价位的能力

两者在 reAPI 上的成本都是每百万 token 输入 $4,输出 $24。OpenAI 自己的标准列表价格对该对也相同,分别为 $5 和 $30。Sol 是新旗舰,增加了 GPT-5.6 代的更新推理、工具使用和明确的提示词缓存控制,而 GPT-5.5 是已经优化过它的团队的稳定基线。[1][2]

对于新的高复杂度部署,从 Sol 开始评估。仅当回归测试显示其既有行为在你的工作负载上赢时才保留 GPT-5.5。

20% 折扣不是最便宜选择的情况

一个清晰的价格表很有用,但三个计费细节可以扭转狭隘的对比。

Batch 和 Flex 处理

OpenAI 为 GPT-5.4 和 GPT-5.5 提供 Batch 和 Flex 处理,标准费率的 50%,以及支持的 GPT-5.6 请求的 Batch 处理。[2][5]如果工作负载可以等待并且不需要立即响应,请比较那些异步价格与 reAPI 的实时费率,而不是仅比较标准处理。

20% reAPI 折扣最直接相关于同步、标准 API 流量。夜间离线充实工作与实时编码代理有不同的经济学。

提示词缓存

OpenAI 为 GPT-5.6 列出的缓存读取价格为无缓存输入价格的 10%。GPT-5.6 还以无缓存输入费率的 1.25 倍计费明确的缓存写入,所以净结果取决于前缀被重用的频率。[1]

对于重用数百次的长系统提示词,缓存命中率可能比 20% 的普通输入价格削减更重要。单独跟踪无缓存输入、缓存写入 token、缓存读取 token 和输出。

长上下文请求

对于 GPT-5.4 和具有 105 万上下文窗口的 GPT-5.6 模型,OpenAI 对超过 272K 输入 token 的提示词,对整个请求的输入价格为 2 倍,输出为 1.5 倍。[4][6]reAPI 公开费率表显示基础模型比率,而不是完整的长上下文发票示例。如果你的提示词超过该阈值,测试代表性请求并在投影节省前验证计费使用。

如何使用较低的 GPT API 费率

reAPI 暴露了一个 OpenAI 兼容端点,所以 Python 客户端只需要不同的基础 URL。此示例使用 Terra,平衡层级:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_REAPI_KEY",
    base_url="https://api.reapi.ai/v1",
)

response = client.chat.completions.create(
    model="gpt-5.6-terra",
    messages=[
        {"role": "user", "content": "Review this pull request for data-loss risks."}
    ],
)

print(response.choices[0].message.content)

可用的模型 id 为:

  • gpt-5.4
  • gpt-5.5
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna

在 API 请求中不要用连字符替换点。reAPI 网站使用连字符页面 slug,但 wire 模型 id 保留 OpenAI 的点号版本号。

安全迁移清单

移动 API 路由很简单;证明新路由经济可行需要更多工作。

  1. 导出代表性样本。 包括短和长提示词、工具调用、结构化输出和已知故障情况。
  2. 固定模型 id。 如果需要稳定的前后结果,不要比较移动别名。
  3. 运行两条路由。 测量答案质量、首 token 延迟、总延迟、输入 token、输出 token、重试和错误。
  4. 计算每个接受结果的成本。 Token 价格仅隐藏重试和人工审查。
  5. 检查功能兼容性。 验证应用程序使用的工具、结构化输出、流和图像输入。
  6. 逐步转移流量。 从小百分比开始,并在错误率和账单与测试匹配之前保持旧路由可用。
  7. 检查实时费率表。 定价可能在发布文章后改变;将模型页面和 API 费率表视为事实来源。

常见问题

OpenAI 降低了 GPT API 价格吗?

在此比较的五个模型中没有。OpenAI 当前公开列表价格保持不变:GPT-5.4 为 $2.50/$15,GPT-5.5 和 GPT-5.6 Sol 为 $5/$30,GPT-5.6 Terra 为 $2.50/$15,GPT-5.6 Luna 为 $1/$6,每百万输入和输出 token。此处描述的 20% 减少是当前 reAPI 费率相对于这些标准价格。[1][2]

哪些 GPT 模型在 reAPI 上便宜 20%?

GPT-5.4、GPT-5.5、GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6 Luna。该折扣适用于 reAPI 默认路由上发布的输入和输出 token 费率。[3]

最便宜的 GPT-5.6 API 模型是什么?

GPT-5.6 Luna。在 OpenAI 的标准费率下每百万 token 成本为 $1 输入和 $6 输出,或在 reAPI 当前默认路由上 $0.80 输入和 $4.80 输出。[3][4]

GPT-5.6 Terra 比 GPT-5.4 便宜吗?

不。在此比较中它们具有相同的 token 价格:reAPI 上为 $2/$12,OpenAI 上为 $2.50/$15。Terra 更新,但最佳价值取决于任务成功、token 效率和迁移风险。

GPT-5.6 Sol 比 GPT-5.5 便宜吗?

不。两者在 reAPI 上都是每百万输入/输出 token $4/$24,在 OpenAI 标准费率上为 $5/$30。Sol 在相同的 token 价格下提供更新的能力层级。[1]

reAPI 提供折扣的缓存输入吗?

当前公开费率表没有为这些折扣默认路由公布单独的缓存输入比率。不要假设一个。比较真实的缓存工作负载并在迁移前检查实时计费。

我可以继续使用 OpenAI Python SDK 吗?

可以。将 base_url 设置为 https://api.reapi.ai/v1,使用 reAPI key,并保留规范的点号 GPT 模型 id。

价格下降很有用;每个结果的成本才是决策因素

统一的 20% 折扣异常容易预算。保持工作负载和模型固定,$1,000 的标准 token 账单变为大约 $800。更有价值的机会是模型路由:Luna 用于常规容量,Terra 用于平衡默认,Sol 仅在前沿能力足以支付自身成本时。

因此,诚实的标题比"OpenAI 降价"更窄,对开发者更有用:五个现有 GPT 模型现在以 reAPI 上 OpenAI 标准 token 费率的 80% 运行。验证你的缓存模式、长上下文使用和异步选项,然后在转移生产流量前测量每个接受结果的成本。

参考资料

  1. OpenAI. GPT-5.6: Frontier intelligence that scales with your ambition. Pricing and tier details. openai.com/index/gpt-5-6
  2. OpenAI. Introducing GPT-5.5. API pricing and processing options. openai.com/index/introducing-gpt-5-5
  3. reAPI. Live public API pricing. Retrieved August 1, 2026. api.reapi.ai/api/pricing
  4. OpenAI. GPT-5.6 Luna model. Specifications, pricing, caching, and long-context rules. developers.openai.com/api/docs/models/gpt-5.6-luna
  5. OpenAI. API pricing. Standard and Batch processing rates. openai.com/api/pricing
  6. OpenAI. GPT-5.4 model. Pricing and long-context rules. developers.openai.com/api/docs/models/gpt-5.4

进一步阅读