
reAPI で GPT API が 20% 割安:5 つのモデル
reAPI の GPT API 料金が OpenAI 標準価格から 20% 割安です。GPT-5.4、GPT-5.5、GPT-5.6 Sol・Terra・Luna の実料金を比較します。
最新の GPT API 割引 は誤解しやすいポイントがあります。OpenAI は公開 API の標準リスト価格に対して一括値引きを発表していません。reAPI ユーザーにとって変わったのは経路で、5 つの現行 GPT モデルが OpenAI の標準入出力トークンレートから 20% 割安 でリストアップされるようになりました。
割引の対象は GPT-5.4、GPT-5.5、GPT-5.6 の全ファミリー(Sol、Terra、Luna)です。新しい SDK や移行プロジェクトはありません。既存の OpenAI 互換コードは、ベース URL を変更し、必要に応じてモデル ID を変更するだけで低いレートを利用できます。
本ガイドではすべてのレートを比較し、実際のワークロードで節約額を計算し、OpenAI の Batch API またはプロンプト キャッシングがどの程度影響するかを説明します。
TL;DR
- 5 つの GPT モデルが reAPI では OpenAI 標準リスト価格より 20% 割安です: GPT-5.4、GPT-5.5、GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna。
- これは reAPI の割引であり、OpenAI 全体の値下げではありません。 OpenAI の現在の公開価格は変わっていません。[1][2]
- 最安のルートは GPT-5.6 Luna で、reAPI 上では入力 $0.80、出力 $4.80(百万トークンあたり)です。
- Terra と GPT-5.4 は reAPI で同じトークン価格 を持ちます:入力 $2、出力 $12(百万トークンあたり)。選択前に両方をベンチマークしてください。
- GPT-5.5 と GPT-5.6 Sol も同じレート: reAPI で入力 $4、出力 $24(百万トークンあたり)です。
- 20% トークン割引は 20% の請求額削減をもたらします リクエスト構成とトークン使用量が同じままの場合。出力トークンが少ないモデルはタスク完了あたりの費用をさらに削減できます。
GPT API の割引前後の価格
以下のすべての価格は百万トークンあたりの USD です。「OpenAI リスト」は標準処理を意味し、Batch、Flex、Priority、地域処理、または交渉済みエンタープライズ契約ではありません。reAPI の価格は 2026 年 8 月 1 日のライブ公開レートカードからです。[3]
| モデル | OpenAI 入力 | reAPI 入力 | OpenAI 出力 | reAPI 出力 | 削減額 |
|---|---|---|---|---|---|
| GPT-5.4 | $2.50 | $2.00 | $15.00 | $12.00 | 20% |
| GPT-5.5 | $5.00 | $4.00 | $30.00 | $24.00 | 20% |
| GPT-5.6 Sol | $5.00 | $4.00 | $30.00 | $24.00 | 20% |
| GPT-5.6 Terra | $2.50 | $2.00 | $15.00 | $12.00 | 20% |
| GPT-5.6 Luna | $1.00 | $0.80 | $6.00 | $4.80 | 20% |
OpenAI はこれらのモデルに対して個別のキャッシュ済み入力価格をリストしています。現在の reAPI レートカードは割引されたデフォルト ルートに対してキャッシュ済み入力レートを公開していないので、この比較は推測値を追加していません。反復されるプロンプト プリフィックスは通常入力価格の 20% 関係と同じであると想定するのではなく、別のベンチマークとして扱ってください。
GPT API 割引が実際の請求額に与える影響
エージェントが毎月 1 億個の入力トークンを処理し、2000 万個の出力トークンを生成するとします。トークン使用量が同じの場合、月額計算は次のようになります:
monthly cost = input MTok × input rate + output MTok × output rate
| モデル | OpenAI 標準 | reAPI | 月間節約額 |
|---|---|---|---|
| GPT-5.4 | $550 | $440 | $110 |
| GPT-5.5 | $1,100 | $880 | $220 |
| GPT-5.6 Sol | $1,100 | $880 | $220 |
| GPT-5.6 Terra | $550 | $440 | $110 |
| GPT-5.6 Luna | $220 | $176 | $44 |
パーセンテージは一定ですが、ドル単位の影響は支出とともに増加します。同じキャッシュなし標準トラフィック ミックスで現在月額 $10,000 を支払っているチームは、移行後に大体 $2,000 を保持します。これはモデル動作またはトークン消費量の変化を考慮する前です。
この最後の条件は重要です。API コストは単なるトークンあたりの価格ではありません:
cost per successful task
= price per token × tokens per attempt × attempts per success2 回の再試行が必要な安いモデルは、1 回で成功する高い模型より費用がかかる可能性があります。より簡潔なモデルは請求可能な出力トークンを減らすことで表を上回ることができます。OpenAI は GPT-5.6 がトークン効率を向上させると述べているので、慎重に評価された移行は見出しの 20% トークンあたり割引以上の節約をもたらすかもしれません。[1]
割引対象の GPT モデルのうち、どれを使うべきか?
表は同一価格ペアを作成しており、これは単に最新モデルを選択するよりも購買決定をより興味深いものにします。
GPT-5.6 Luna:ボリューム デフォルト
Luna はこのグループで最も価格が低いモデルです。OpenAI はコスト意識の高い大量の作業に向けて配置しており、105M トークンコンテキスト ウィンドウと 128K の最大出力があります。これは分類、抽出、ランキング、ルーチン サポート、および安価なエージェント サブタスクの最初の候補です。[4]
reAPI で入力 $0.80、出力 $4.80(百万トークンあたり)では、Luna は Terra より両方の次元で 60% 安いです。価格ギャップを使って適切な eval を実行してください。スキップしてはいけません:タスク完了、再試行、レイテンシー、および総出力トークンを測定してください。
GPT-5.6 Terra と GPT-5.4 の比較:同じ価格、新しいティア
両方とも reAPI で入力 $2、出力 $12(百万トークンあたり)の費用がかかります。Terra は OpenAI がバランスの取れた GPT-5.6 ティアとして説明し、GPT-5.5 と競争力を持ちながら フラッグシップより低く価格設定されているため、自然な最初のテストです。[1]
既存の本番環境プロンプトがすでに検証されている場合、GPT-5.4 は引き続き役立ちます。同じ価格の移行は自動的に無料ではありません:モデル動作、推論デフォルト、キャッシュ動作、および出力長は変わる可能性があります。すべてのトラフィックを移動する前にシャドウ比較を実行してください。
GPT-5.6 Sol と GPT-5.5 の比較:同じレートの機能
両方とも reAPI で入力 $4、出力 $24(百万トークンあたり)の費用がかかります。OpenAI の標準リスト価格も $5 と $30 でペアに対して同一です。Sol は新しいフラッグシップで、GPT-5.6 世代の更新された推論、ツール使用、および明示的なプロンプト キャッシング制御を追加しますが、GPT-5.5 はすでに チューニングされているチームの安定基盤です。[1][2]
新しい高複雑度デプロイメントについては、Sol での評価から始めてください。回帰テストが確立された動作があなたのワークロードで勝つことを示す場合にのみ、GPT-5.5 を保持してください。
20% オフが最も安いオプションでない場合
きれいな価格表は便利ですが、3 つの課金の詳細により狭い比較を逆転させることができます。
Batch と Flex 処理
OpenAI は GPT-5.4 および GPT-5.5 に対して標準レートの 50% で Batch および Flex 処理を提供し、サポートされている GPT-5.6 リクエストに対して Batch 処理を提供します。[2][5]ワークロードが待つことができ、即座の応答を必要としない場合、これらの非同期価格を reAPI のライブ レートと比較して、標準処理のみと比較する代わりに。
20% reAPI 割引は最も直接的には同期的で標準 API トラフィックに関連します。夜間のオフライン エンリッチメント ジョブはライブ コーディング エージェントと異なる経済学を持っています。
プロンプト キャッシング
OpenAI はキャッシュされた読み取りをキャッシュされていない入力価格の 10% で GPT-5.6 にリストしています。GPT-5.6 はまた、明示的なキャッシュ書き込みをキャッシュされていない入力レートの 1.25 倍で請求するため、正味の結果はプリフィックスが再利用される頻度に依存します。[1]
数百回再利用される長いシステム プロンプトの場合、キャッシュ ヒット レートは通常の入力価格の 20% 削減より重要になる可能性があります。キャッシュされていない入力、キャッシュ書き込みトークン、キャッシュ読み取りトークン、および出力を個別に追跡してください。
長コンテキスト リクエスト
105M コンテキスト ウィンドウを持つ GPT-5.4 と GPT-5.6 モデルの場合、OpenAI は 272K 入力トークンを超えるプロンプトに対して 2 倍の入力と 1.5 倍の出力を全リクエストに対して価格設定します。[4][6]reAPI パブリック レート カードは基本モデル比率を示し、完全な長コンテキスト請求書の例ではありません。プロンプトがそのしきい値を超える場合、代表的なリクエストをテストし、節約を計画する前に課金された使用状況を確認してください。
より低い GPT API レートの使い方
reAPI は OpenAI 互換エンドポイントを公開しているため、Python クライアントは別のベース URL だけが必要です。この例では、バランスの取れたティアである Terra を使用します:
from openai import OpenAI
client = OpenAI(
api_key="YOUR_REAPI_KEY",
base_url="https://api.reapi.ai/v1",
)
response = client.chat.completions.create(
model="gpt-5.6-terra",
messages=[
{"role": "user", "content": "Review this pull request for data-loss risks."}
],
)
print(response.choices[0].message.content)利用可能なモデル ID は以下のとおりです:
gpt-5.4gpt-5.5gpt-5.6-solgpt-5.6-terragpt-5.6-luna
API リクエストでドットをハイフンに置き換えないでください。reAPI ウェブサイトはハイフン付きページスラッグを使用しますが、ワイヤ モデル ID は OpenAI のドット付きバージョン番号を保持します。
安全な移行チェックリスト
API ルートを移動するのは簡単です。新しいルートが経済的であることを証明するにはもう少し作業が必要です。
- 代表的なサンプルをエクスポートします。 短いプロンプトと長いプロンプト、ツール呼び出し、構造化出力、および既知の失敗ケースを含めます。
- モデル ID をピンします。 安定した前後の結果が必要な場合は、移動するエイリアスを比較しないでください。
- 両方のルートを実行します。 回答品質、最初のトークン レイテンシー、合計レイテンシー、入力トークン、出力トークン、再試行、およびエラーを測定してください。
- 受け入れられた結果あたりのコストを計算してください。 トークン価格だけでは再試行と人間による確認を隠しています。
- 機能の互換性を検査します。 アプリケーションで使用されるツール、構造化出力、ストリーミング、および画像入力を検証してください。
- トラフィックを段階的に移動します。 小さなパーセンテージで開始し、エラー レートと請求額がテストと一致するまで古いルートを利用できるようにしてください。
- ライブ レート カードを確認します。 記事が公開された後、価格が変わる可能性があります。モデル ページと API レート カードを真実のソースとして扱ってください。
FAQ
OpenAI は GPT API 価格を引き下げましたか?
この比較の 5 つのモデルには適用されません。OpenAI の現在の公開リスト価格は、百万トークンあたりの入出力に対して GPT-5.4 は $2.50/$15、GPT-5.5 および GPT-5.6 Sol は $5/$30、GPT-5.6 Terra は $2.50/$15、GPT-5.6 Luna は $1/$6 のままです。ここで説明する 20% 削減は、これらの標準価格に対する現在の reAPI レートです。[1][2]
どの GPT モデルが reAPI で 20% 安いですか?
GPT-5.4、GPT-5.5、GPT-5.6 Sol、GPT-5.6 Terra、および GPT-5.6 Luna。割引は reAPI のデフォルト ルートで公開されている入出力トークンレートに適用されます。[3]
最も安い GPT-5.6 API モデルは何ですか?
GPT-5.6 Luna。OpenAI の標準レートで百万トークンあたり入力 $1、出力 $6 の費用がかかるか、reAPI の現在のデフォルト ルートで入力 $0.80、出力 $4.80 の費用がかかります。[3][4]
GPT-5.6 Terra は GPT-5.4 より安いですか?
いいえ。この比較ではトークン価格が同じです:reAPI で $2/$12、OpenAI で $2.50/$15。Terra はより新しいですが、最良の価値はタスク成功、トークン効率、および移行リスクによって異なります。
GPT-5.6 Sol は GPT-5.5 より安いですか?
いいえ。両方とも reAPI で百万トークンあたり入力/出力 $4/$24、OpenAI の標準レートで $5/$30 です。Sol は同じトークンあたり価格でより新しい機能ティアを提供します。[1]
reAPI はディスカウント キャッシュ入力を提供していますか?
現在のパブリック レート カードは、これらの割引されたデフォルト ルートに対して個別のキャッシュ済み入力比率を公開していません。推測値を想定しないでください。実際のキャッシュ ワークロードを比較し、移行前にライブ請求額を確認してください。
OpenAI Python SDK を使い続けることができますか?
はい。base_url を https://api.reapi.ai/v1 に設定し、reAPI キーを使用し、標準的なドット付き GPT モデル ID を保持してください。
価格割引は役に立ちます。結果あたりのコストが決定です
一律 20% 削減は予算計算が異常に簡単です。ワークロードとモデルを固定したままにすると、$1,000 の標準トークン請求額は大体 $800 になります。より価値のある機会はモデル ルーティングです:ルーチン ボリュームの場合は Luna、バランスの取れたデフォルトの場合は Terra、フロンティア機能が成功率を自分で支払うのに十分に改善する場所でのみ Sol。
正直な見出しは「OpenAI が価格を削減した」よりも狭く、開発者にとってより有用です:5 つの現在の GPT モデルが reAPI で OpenAI 標準トークンレートの 80% で実行されるようになりました。キャッシュ パターン、長コンテキスト使用、および非同期オプションを確認してから、本番トラフィックを移動する前に受け入れられた結果あたりのコストを測定してください。
References
- OpenAI. GPT-5.6: Frontier intelligence that scales with your ambition. Pricing and tier details. openai.com/index/gpt-5-6
- OpenAI. Introducing GPT-5.5. API pricing and processing options. openai.com/index/introducing-gpt-5-5
- reAPI. Live public API pricing. Retrieved August 1, 2026. api.reapi.ai/api/pricing
- OpenAI. GPT-5.6 Luna model. Specifications, pricing, caching, and long-context rules. developers.openai.com/api/docs/models/gpt-5.6-luna
- OpenAI. API pricing. Standard and Batch processing rates. openai.com/api/pricing
- OpenAI. GPT-5.4 model. Pricing and long-context rules. developers.openai.com/api/docs/models/gpt-5.4
Further reading
- reAPI. How to use GPT-5.6. reapi.ai/blog/how-to-use-gpt-5-6
- reAPI. How to use GPT-5.5. reapi.ai/blog/how-to-use-gpt-5-5
- reAPI. GPT-5.6 model catalog. reapi.ai/models
著者

カテゴリ
他の記事

Seedance 2.5 API料金比較:四社の実価格
Seedance 2.5のAPI料金を2026年8月に四社で比較。reAPI、fal.ai、kie.ai、WaveSpeed。価格差は最大1.8倍、参照動画の課金ルール異なり、実例3つ付き。


Astraコンテキスト窓:Codexが258K表示する理由
GPT-6 Astraの1.05Mトークンコンテキスト窓、Codexセッションが258Kを表示する理由、圧縮を生き残る設計方法を解説します。


Wan 3.0はオープンソース?重みとAPI、ローカル実行の全て
Wan 3.0はAPIで利用可能ですが、公開重みはありません(2026年8月時点)。利用可能な内容と、Wan 2.2がローカルの選択肢として機能する場合を解説します。
