
OpenAI
GPT-5.4
起 $1.00 每 1M tokens
可以用这个模型构建并上线的真实工作流与生产级用例。

这正是 OpenAI 为最低努力度点名的工作:快速信息检索和分类——在这类任务上推理只增加延时,别无所得。把努力度关掉,用 schema 约束输出,GPT-5.6 Luna 就成了一个组件而不是一个神谕:同一个 prompt 跑一百万行,而账还算得过来。值得注意的一点是,降到这一档并不会缩小你的输入:GPT-5.6 Luna 读的是与旗舰档相同的 1,050,000 token 窗口,所以一份长文档不会仅仅为了塞得进去而把你逼回价格阶梯上方。
阅读 API 文档
生产流量的大多数并不难。一条两级路由——建在 GPT-5.6 Luna 上,由它读完全部并判断哪些是例行的,只有非例行的才交给更贵的模型——是对话工作负载上最有效的单一成本手段,而它之所以成立,恰恰因为这里便宜的那一级不是一个弱模型,而是同一家族的更小档位,限制相同、接口相同。同一把 Key、同一个 endpoint、只差一个 model 字符串:升级是请求里的一个字段,不是第二次集成。

语音、自动补全、实时审核,任何有人在等的场景:OpenAI 自己的建议是先试 low,需要的话再降到 none。GPT-5.6 Luna 是执行这条建议成本最低的一档,而且它的速度评级本来就是 Fast。prompt 短一点、输出封顶,把努力度当成你在换供应商之前先转的那个旋钮——家族的快路径和深路径是同一套 API。
积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。
| 类别 | 单位 | 价格 |
|---|---|---|
| Token 计费 | ||
| 输入 | 1M tokens | $0.8 |
| 输出 | 1M tokens | $4.8 |
OpenAI 为 GPT-5.6 Luna 的输入和输出公布了每百万 token 的价格。在 reAPI 上,GPT-5.6 Luna 两项都低 20%——两个维度同一个折扣,所以你现有的成本模型按一个数字整体下调即可。底下没有订阅,没有最低消费,按量以美元从你的网关余额扣费。具体数字见本页的价格表。
GPT-5.6 Luna 通过标准的 `/v1/chat/completions` 接口提供。如果你的代码已经在说这套协议,接入 GPT-5.6 Luna 就是一个 base URL、一把 Key 和一个 model 字符串的事——base URL 指向网关之后,原来的 SDK 照旧可用。不用换 SDK,不需要专用客户端。
调用 GPT-5.6 Luna 的那把 api.reapi.ai Key,同样能调用它更大的同门、Claude 与 Gemini 系列,以及开源权重的那几档。这才让分档路由真的可行:升级目标是一个 model 字符串,而不是第二段供应商关系、第二张发票和第二套凭证。
这才是真正决定一条路由的对比,而且它异常干净,因为 GPT-5.6 Luna 与 GPT-5.6 Terra 几乎共享一切:相同的上下文窗口、相同的输出上限、相同的努力度阶梯、相同的工具、相同的知识截止、相同的接口。不同的是 OpenAI 给各自评定的推理余量、它们各自承接的血脉,以及价格。下面这些行请这样读:这条路由需要的是判断,还是吞吐?
对比依据撰写时 OpenAI 自家模型页面记录的行为。价格只描述关系而不给具体金额;GPT-5.6 Luna 的实时数字见上方价格表。
在 api.reapi.ai 注册,打开控制台生成一把 API Key。这一把 Key 就能访问 GPT-5.6 Luna 和网关上其它所有模型,从同一份余额扣费。
打开把 base URL 设成 api.reapi.ai,Key 换成刚创建的那一把。任何已经在说 OpenAI Chat Completions 的客户端都不用改就能跑——接 GPT-5.6 Luna 不需要换 SDK。
打开把 model 字段设为 `gpt-5.6-luna`——带上那些点——然后 POST 你的 messages。在这一档请显式设定推理努力度:家族默认是 medium,而在高并发路由上你真正想要的通常是 none 或 low。
打开关于此模型的常见疑问。