Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references

GPT-5.6 Luna — 量产档,1.05M 上下文一分不减

GPT-5.6 Luna 是 OpenAI 在 GPT-5.6 家族里的成本敏感档,有意思的地方在于它没有削减什么:GPT-5.6 Luna 拥有与旗舰同门完全相同的 1,050,000 token 上下文窗口、相同的 128,000 token 最大输出、以及相同的六档推理拨盘。变的是价格,和你会合理地要求它思考到多深。在 reAPI 上,GPT-5.6 Luna 的输入与输出都低于 OpenAI 官方公布价。

模型特点
推理档位分级 · 工具 & JSON 模式
适用场景
快速回复、日常任务
输入
聊天消息(OpenAI 兼容)
输出
文本,支持流式输出
GPT-5.6 Luna

向 GPT-5.6 Luna 提问

直接使用输入框中的默认提示词,或选择一个示例。

Enter 发送 · Shift+Enter 换行

什么是 GPT-5.6 Luna API?

GPT-5.6 Luna 是 GPT-5.6 家族中面向成本敏感场景的一档,在 reAPI 上通过 OpenAI 兼容的 /api/v1/chat/completions 端点提供。它并没有在规格上打折——同样的 1,050,000 token 上下文窗口、同样的 128,000 token 最大输出、同样从 none 到 max 的六档推理努力度(默认 medium),支持文本与图片输入、文本输出。计费按每 1M tokens 计算,输入与输出分别定价;推理 token 按输出计费。

你能用这个模型做什么

可以用这个模型构建并上线的真实工作流与生产级用例。

GPT-5.6 Luna 在关闭推理的情况下给一队文档分类

分类与抽取,按整条队列来定价

这正是 OpenAI 为最低努力度点名的工作:快速信息检索和分类——在这类任务上推理只增加延时,别无所得。把努力度关掉,用 schema 约束输出,GPT-5.6 Luna 就成了一个组件而不是一个神谕:同一个 prompt 跑一百万行,而账还算得过来。值得注意的一点是,降到这一档并不会缩小你的输入:GPT-5.6 Luna 读的是与旗舰档相同的 1,050,000 token 窗口,所以一份长文档不会仅仅为了塞得进去而把你逼回价格阶梯上方。

阅读 API 文档
GPT-5.6 Luna 做请求初筛,只把难的升级上去

贵模型前面那一道便宜的初筛

生产流量的大多数并不难。一条两级路由——建在 GPT-5.6 Luna 上,由它读完全部并判断哪些是例行的,只有非例行的才交给更贵的模型——是对话工作负载上最有效的单一成本手段,而它之所以成立,恰恰因为这里便宜的那一级不是一个弱模型,而是同一家族的更小档位,限制相同、接口相同。同一把 Key、同一个 endpoint、只差一个 model 字符串:升级是请求里的一个字段,不是第二次集成。

GPT-5.6 Luna 不经推理直接回答一个延时敏感请求

思考本身就是错工具的延时关键路径

语音、自动补全、实时审核,任何有人在等的场景:OpenAI 自己的建议是先试 low,需要的话再降到 none。GPT-5.6 Luna 是执行这条建议成本最低的一档,而且它的速度评级本来就是 Fast。prompt 短一点、输出封顶,把努力度当成你在换供应商之前先转的那个旋钮——家族的快路径和深路径是同一套 API。

价格

积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。

首次测试成本
$0.00111.12 credits

最低档一次 1K token 提示加 1K token 回答。

测试预算参考
充值积分
$10
约 8928 次测试
$50
约 44642 次测试
$100
约 89285 次测试
模型类别价格
Token 计费输入
$0.16
1M tokens
输出
$0.96
1M tokens
长上下文 · 提示长度超过 272K tokens输入
$0.32
1M tokens
输出
$1.44
1M tokens

为什么选 reAPI

低于官方公布价

OpenAI 为 GPT-5.6 Luna 的输入和输出公布了每百万 token 的价格。在 reAPI 上,GPT-5.6 Luna 两项都更低,本页的价格实时更新。底下没有订阅,没有最低消费,按量从你的 reAPI 余额扣费。具体数字见本页的价格表。

OpenAI 兼容,直接换上就能用

GPT-5.6 Luna 通过标准的 `/api/v1/chat/completions` 接口提供。如果你的代码已经在说这套协议,接入 GPT-5.6 Luna 就是一个 base URL、一把 Key 和一个 model 字符串的事——base URL 指向 reapi.ai 之后,原来的 SDK 照旧可用。不用换 SDK,不需要专用客户端。

一把 Key 覆盖整条阶梯

调用 GPT-5.6 Luna 的那把 reAPI Key,同样能调用它更大的同门、Claude 与 Gemini 系列,以及开源权重的那几档。这才让分档路由真的可行:升级目标是一个 model 字符串,而不是第二段供应商关系、第二张发票和第二套凭证。

GPT-5.6 Luna 与 GPT-5.6 Terra 对比

这才是真正决定一条路由的对比,而且它异常干净,因为 GPT-5.6 Luna 与 GPT-5.6 Terra 几乎共享一切:相同的上下文窗口、相同的输出上限、相同的努力度阶梯、相同的工具、相同的知识截止、相同的接口。不同的是 OpenAI 给各自评定的推理余量、它们各自承接的血脉,以及价格。下面这些行请这样读:这条路由需要的是判断,还是吞吐?

能力
reAPI 上的 GPT-5.6 Luna
GPT-5.6 Terra
OpenAI 的定位
面向成本敏感、高并发工作负载优化
在智能与成本之间取平衡
推理评级
High——家族的入门评级
Higher——高一档
上一代血脉
对应早前 GPT-5 各代的 nano 档
对应 mini 档
reAPI 上的价格
三档中最低的一档——见上方价格表
高于 Luna,低于旗舰档
上下文与输出上限
1,050,000 token 上下文,128,000 token 最大输出
完全相同——限制不随档位变化
努力度阶梯与工具
六档全有,函数、联网搜索、文件检索、电脑操作
完全相同——区别在于哪几档值得付钱

对比依据撰写时 OpenAI 自家模型页面记录的行为。价格只描述关系而不给具体金额;GPT-5.6 Luna 的实时数字见上方价格表。

三步用上 GPT-5.6 Luna

  1. step 01

    创建一把 reAPI API Key

    登录 reAPI,在 API Keys 下创建一把 Key。这一把 Key 就能访问 GPT-5.6 Luna 和平台上其它所有模型,从同一份余额扣费。

    打开
  2. step 02

    把客户端指向 reapi.ai

    把 base URL 设成 reapi.ai 的 API,Key 换成刚创建的那一把。任何已经在说 OpenAI Chat Completions 的客户端都不用改就能跑——接 GPT-5.6 Luna 不需要换 SDK。

    打开
  3. step 03

    把 model 设成 `gpt-5.6-luna`

    把 model 字段设为 `gpt-5.6-luna`——带上那些点——然后 POST 你的 messages。在这一档请显式设定推理努力度:家族默认是 medium,而在高并发路由上你真正想要的通常是 none 或 low。

    打开
docs/api/gpt-5-6-luna

API 参考

复制即用的代码片段与完整参数表。

curl https://reapi.ai/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-luna",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "low",
    "stream": true
  }'

参数校验失败

提交时同步拒绝并指明出错字段。检查枚举值、范围与 URL 字段——不产生任何扣费。

认证或余额问题

401 表示 Bearer 密钥缺失或无效;402 表示预扣额超出余额。密钥与积分在控制台管理。

内容或素材被拒

参考素材与生成结果都会经过自动审核。被拒的任务返回明确错误并全额退款。

任务失败或超时

进入失败状态的任务不会扣费——预扣自动退还。保留任务 ID,随时可重试。

常见问题

关于此模型的常见疑问。

GPT-5.6 Luna 按 token 从你的 reAPI 余额按量计费,输入和输出分别计价,没有订阅。两项都低于 OpenAI 官方公布价。当前数字见本页的价格表。

start building

准备好上线了吗?

在 Playground 中试用,或直接获取 API Key 立即接入。