
OpenAI
GPT-5.6 Luna
起 $0.800 每 1M tokens
GPT-5.4 是 OpenAI 成熟稳定的推理模型,在 reAPI 上以可直接替换的 OpenAI 兼容 /v1/chat/completions 端点提供。它读取 1M token 的上下文窗口,单次最多返回 128K token,并覆盖函数调用、JSON 模式输出与低延迟流式响应——在 GPT 系列中,它是面向生产流量的高性价比选择,适合那些无需 GPT-5.5 最新推理增益的场景。计费按每 1M tokens 计算,输入与输出分别定价。
可以用这个模型构建并上线的真实工作流与生产级用例。

把 GPT-5.4 作为聊天机器人、客服助手或内部 copilot 背后的默认模型。它在 GPT 系列中性价比高,能把单次请求成本压得很低,同时仍然在同一个接口下获得 OpenAI 兼容的推理、流式输出与工具调用能力。
查看 API 文档
把整份政策文档、会议转录、合同或研究资料一次性喂给 GPT-5.4。1M token 的上下文窗口意味着你几乎不必再切块——模型可以一次看完整篇内容,输出连贯的摘要、审阅意见或对比分析。

从自由文本中抽取结构化 JSON,把工单和评价归类到固定分类法中,或把杂乱字段对齐到既定 schema。GPT-5.4 通过 `response_format` 和标准 OpenAI 工具调用稳定返回 JSON,不需要再写自定义解析器。
积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。
最低档一次生成(1M tokens)。
| 模型 | 类别 | 价格 |
|---|---|---|
| Token 计费 | 输入 tokens | $1 1M tokens |
| 输出 tokens | $6 1M tokens |
GPT-5.4 API 与 OpenAI Chat Completions 完全对齐。把现有 OpenAI 集成迁过来,只需改 base URL、换 API key、改 model 字符串——不是平台重写。同样的 `messages` 数组,同样的 `stream` / `temperature` / `top_p` / `frequency_penalty` / `presence_penalty` 参数,同样的 SSE 传输格式。
GPT-5.4 是 GPT 系列中价格最低的模型——pay-as-you-go,按美元计费,无月度最低消费。当你的工作负载已经定型、调用量大、单次成本比榨取最后几分推理质量更重要时,选它就对了。
一把 api.reapi.ai 的 key,同时解锁 GPT-5.4 与 GPT-5.5、Claude Opus 4.7、Gemini 3.1 Pro,以及平台上所有其他前沿对话模型。比较厂商、加 fallback、按调用粒度切流量——改一行配置即可,不是一个集成项目。
curl https://api.reapi.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"group": "default",
"messages": [
{ "role": "user", "content": "Hello" }
],
"stream": true,
"temperature": 0.7,
"top_p": 1,
"frequency_penalty": 0,
"presence_penalty": 0
}'提交时同步拒绝并指明出错字段。检查枚举值、范围与 URL 字段——不产生任何扣费。
401 表示 Bearer 密钥缺失或无效;402 表示预扣额超出余额。密钥与积分在控制台管理。
参考素材与生成结果都会经过自动审核。被拒的任务返回明确错误并全额退款。
进入失败状态的任务不会扣费——预扣自动退还。保留任务 ID,随时可重试。
关于此模型的常见疑问。