
OpenAI
GPT-5.4
〜から $1.00 1M トークンあたり
GPT-5.6 Luna は GPT-5.6 ファミリーにおける OpenAI のコスト重視ティアですが、面白いのは削っていないものです。GPT-5.6 Luna は最上位モデルとまったく同じ 1,050,000 トークンのコンテキストウィンドウ、同じ 128,000 トークンの最大出力、同じ 6 段階の推論ダイヤルを備えます。変わるのは価格と、妥当に求めるべき思考の深さです。reAPI では、GPT-5.6 Luna の入力・出力いずれも OpenAI 公表レートより低くなります。
入力欄のプロンプトから始めるか、例を選んでください。
GPT-5.6 Luna は GPT-5.6 ファミリーのコスト重視ティアで、reAPI では OpenAI 互換の /api/v1/chat/completions エンドポイントで提供されます。ファミリーの上限を一切妥協していません。1,050,000 トークンのコンテキストウィンドウ、128,000 トークンの最大出力、none から max までの 6 段階の推論 effort(既定は medium)はいずれも同じで、入力はテキストと画像、出力はテキストです。課金は 1M トークンあたりで、入力と出力は別々に価格設定され、推論トークンは出力として計上されます。
このモデルで構築して本番に出せる、実際のワークフローとユースケースをご紹介します。

これは OpenAI が最低 effort に対して名指しする作業です。素早い情報検索と分類 — 推論は遅延を増やすだけで、他に何も足しません。effort を切り、スキーマで出力を縛れば、GPT-5.6 Luna は神託ではなく部品になります。同じプロンプトを 100 万行に、しかも計算が成立するレートで。注目すべきは、このティアに落としても入力は縮まないことです。GPT-5.6 Luna が読むのは最上位ティアと同じ 1,050,000 トークンの窓なので、長い文書のために価格の階段を上り直す必要はありません。
API ドキュメントを読む
本番トラフィックの大半は難しくありません。GPT-5.6 Luna の上に組む二段ルート — すべてを読んで定型かどうかを判断し、定型でないものだけを高価なモデルに見せる — は、チャット系ワークロードで最も効く単一のコスト手段です。そしてそれが成り立つのは、ここでの安価な段が弱いモデルではなく、同じファミリーの小さいティアで、限界値もインターフェースも同じだからです。同じキー、同じエンドポイント、model 文字列 1 つの違い。エスカレーションはリクエストのフィールドであって、2 つめの実装ではありません。

音声、入力補完、リアルタイムのモデレーション、人が待っているあらゆる場面 — これらに対する OpenAI 自身の助言は、まず low を試し、必要なら none に移ることです。GPT-5.6 Luna はその助言を最も安く実行できるティアで、しかも速度評価はもともと Fast です。プロンプトを短く保ち、出力に上限をかけ、別のプロバイダーを探し始める前に回すダイヤルとして effort を扱ってください。ファミリーの速い経路と深い経路は同じ API です。
クレジット制 — 1クレジット = 0.001 USD。完了した生成のみお支払いいただきます。
最安ティアで 1K トークンのプロンプトと 1K トークンの回答。
| モデル | カテゴリ | 料金 |
|---|---|---|
| トークン課金 | 入力 | $0.16 1M tokens |
| 出力 | $0.96 1M tokens | |
| 長いコンテキスト · 272K トークンを超えるプロンプト | 入力 | $0.32 1M tokens |
| 出力 | $1.44 1M tokens |
OpenAI は GPT-5.6 Luna の入力と出力について 100 万トークンあたりの単価を公表しています。reAPI では GPT-5.6 Luna は両方とも低くなり、本ページの料金はライブで更新されます。裏にサブスクリプションはなく、最低利用額もなく、reAPI 残高からの従量課金です。正確な数値は本ページの料金表にあります。
GPT-5.6 Luna は標準の `/api/v1/chat/completions` エンドポイントから提供されます。既存のコードがこの形を話しているなら、GPT-5.6 Luna の採用は base URL とキー、そして model 文字列だけの話です。base URL を reapi.ai に向ければ同じ SDK がそのまま動きます。SDK の入れ替えも専用クライアントも不要です。
GPT-5.6 Luna を呼ぶ reAPI のキーは、上位の同門、Claude と Gemini のファミリー、そしてオープンウェイトのティアも呼べます。だからこそ段階的なルーティングが実用になります。エスカレーション先は model 文字列であって、独自の請求書と資格情報を伴う 2 つめのベンダー関係ではありません。
これが実際にルートを決める比較で、しかも異例に見通しがよいものです。GPT-5.6 Luna と GPT-5.6 Terra はほとんどすべてを共有します。同じコンテキストウィンドウ、同じ出力上限、同じ effort の段階、同じツール、同じ知識カットオフ、同じエンドポイント。違うのは OpenAI が各々に与えた推論の余裕、受け継ぐ系譜、そして価格です。以下の行はこう読んでください。このルートに必要なのは判断か、それともスループットか。
比較は執筆時点で OpenAI 自身のモデルページに記載された挙動に基づきます。レートは金額ではなく関係として記述しています。GPT-5.6 Luna の実際の数値は上の料金表にあります。
reAPI にサインインし、API キーの画面でキーを作成します。この 1 本のキーで GPT-5.6 Luna とプラットフォーム上の他のすべてのモデルに届き、課金は単一の残高からまとめて行われます。
開くbase URL を reapi.ai の API に、キーを今作ったものに設定します。すでに OpenAI Chat Completions を話しているクライアントはそのまま動作し、GPT-5.6 Luna に届くのに SDK の入れ替えは不要です。
開くmodel フィールドを `gpt-5.6-luna` — ドット付き — にして messages を POST します。このティアでは推論 effort を明示的に決めてください。ファミリーの既定は medium ですが、大量処理のルートで実際に欲しいのは通常 none か low です。
開くcurl https://reapi.ai/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-luna",
"messages": [
{ "role": "user", "content": "Hello" }
],
"reasoning_effort": "low",
"stream": true
}'送信時に同期的に拒否され、問題のフィールドが示されます。列挙値・範囲・URL フィールドを確認してください。課金は発生しません。
401 は Bearer キーの欠落または無効、402 は仮押さえ額が残高を超過。キーとクレジットはコンソールで管理できます。
参照素材と生成結果は自動審査を通過します。拒否されたタスクは明確なエラーで失敗し、全額返金されます。
失敗状態に達したタスクは課金されません。仮押さえは自動返金されます。タスク ID を保持して再試行してください。
このモデルに関するよくある質問。