
OpenAI
GPT-5.4
起 $1.00 每 1M tokens
直接使用输入框中的默认提示词,或选择一个示例。
GPT-5.6 Luna 是 GPT-5.6 家族中面向成本敏感场景的一档,在 reAPI 上通过 OpenAI 兼容的 /api/v1/chat/completions 端点提供。它并没有在规格上打折——同样的 1,050,000 token 上下文窗口、同样的 128,000 token 最大输出、同样从 none 到 max 的六档推理努力度(默认 medium),支持文本与图片输入、文本输出。计费按每 1M tokens 计算,输入与输出分别定价;推理 token 按输出计费。
可以用这个模型构建并上线的真实工作流与生产级用例。

这正是 OpenAI 为最低努力度点名的工作:快速信息检索和分类——在这类任务上推理只增加延时,别无所得。把努力度关掉,用 schema 约束输出,GPT-5.6 Luna 就成了一个组件而不是一个神谕:同一个 prompt 跑一百万行,而账还算得过来。值得注意的一点是,降到这一档并不会缩小你的输入:GPT-5.6 Luna 读的是与旗舰档相同的 1,050,000 token 窗口,所以一份长文档不会仅仅为了塞得进去而把你逼回价格阶梯上方。
阅读 API 文档
生产流量的大多数并不难。一条两级路由——建在 GPT-5.6 Luna 上,由它读完全部并判断哪些是例行的,只有非例行的才交给更贵的模型——是对话工作负载上最有效的单一成本手段,而它之所以成立,恰恰因为这里便宜的那一级不是一个弱模型,而是同一家族的更小档位,限制相同、接口相同。同一把 Key、同一个 endpoint、只差一个 model 字符串:升级是请求里的一个字段,不是第二次集成。

语音、自动补全、实时审核,任何有人在等的场景:OpenAI 自己的建议是先试 low,需要的话再降到 none。GPT-5.6 Luna 是执行这条建议成本最低的一档,而且它的速度评级本来就是 Fast。prompt 短一点、输出封顶,把努力度当成你在换供应商之前先转的那个旋钮——家族的快路径和深路径是同一套 API。
积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。
最低档一次 1K token 提示加 1K token 回答。
| 模型 | 类别 | 价格 |
|---|---|---|
| Token 计费 | 输入 | $0.16 1M tokens |
| 输出 | $0.96 1M tokens | |
| 长上下文 · 提示长度超过 272K tokens | 输入 | $0.32 1M tokens |
| 输出 | $1.44 1M tokens |
OpenAI 为 GPT-5.6 Luna 的输入和输出公布了每百万 token 的价格。在 reAPI 上,GPT-5.6 Luna 两项都更低,本页的价格实时更新。底下没有订阅,没有最低消费,按量从你的 reAPI 余额扣费。具体数字见本页的价格表。
GPT-5.6 Luna 通过标准的 `/api/v1/chat/completions` 接口提供。如果你的代码已经在说这套协议,接入 GPT-5.6 Luna 就是一个 base URL、一把 Key 和一个 model 字符串的事——base URL 指向 reapi.ai 之后,原来的 SDK 照旧可用。不用换 SDK,不需要专用客户端。
调用 GPT-5.6 Luna 的那把 reAPI Key,同样能调用它更大的同门、Claude 与 Gemini 系列,以及开源权重的那几档。这才让分档路由真的可行:升级目标是一个 model 字符串,而不是第二段供应商关系、第二张发票和第二套凭证。
这才是真正决定一条路由的对比,而且它异常干净,因为 GPT-5.6 Luna 与 GPT-5.6 Terra 几乎共享一切:相同的上下文窗口、相同的输出上限、相同的努力度阶梯、相同的工具、相同的知识截止、相同的接口。不同的是 OpenAI 给各自评定的推理余量、它们各自承接的血脉,以及价格。下面这些行请这样读:这条路由需要的是判断,还是吞吐?
对比依据撰写时 OpenAI 自家模型页面记录的行为。价格只描述关系而不给具体金额;GPT-5.6 Luna 的实时数字见上方价格表。
登录 reAPI,在 API Keys 下创建一把 Key。这一把 Key 就能访问 GPT-5.6 Luna 和平台上其它所有模型,从同一份余额扣费。
打开把 base URL 设成 reapi.ai 的 API,Key 换成刚创建的那一把。任何已经在说 OpenAI Chat Completions 的客户端都不用改就能跑——接 GPT-5.6 Luna 不需要换 SDK。
打开把 model 字段设为 `gpt-5.6-luna`——带上那些点——然后 POST 你的 messages。在这一档请显式设定推理努力度:家族默认是 medium,而在高并发路由上你真正想要的通常是 none 或 low。
打开curl https://reapi.ai/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-luna",
"messages": [
{ "role": "user", "content": "Hello" }
],
"reasoning_effort": "low",
"stream": true
}'提交时同步拒绝并指明出错字段。检查枚举值、范围与 URL 字段——不产生任何扣费。
401 表示 Bearer 密钥缺失或无效;402 表示预扣额超出余额。密钥与积分在控制台管理。
参考素材与生成结果都会经过自动审核。被拒的任务返回明确错误并全额退款。
进入失败状态的任务不会扣费——预扣自动退还。保留任务 ID,随时可重试。
关于此模型的常见疑问。