
GPT-6 Luna API の料金:トークン単価とコスト計算
OpenAI の料金ページに基づく GPT-6 Luna API の料金:入力、出力、キャッシュの読み取りと書き込み、272K 超の長コンテキスト枠、Batch と Fast、コストの計算例。
GPT-6 Luna API の料金は、OpenAI の Standard ティアで入力 100 万トークンあたり $0.10、出力 100 万トークンあたり $0.50 からで、GPT-6 シリーズで最も低い単価です[1]。ただし、この 2 つの数字は請求額の一部にすぎません。キャッシュ入力、キャッシュ書き込み、272K トークンを超えるプロンプトに適用される別単価、そして出力として課金される推論トークンが、実際のコストを左右します。
この記事では、OpenAI の料金ページ(2026年10月7日取得)に載っている GPT-6 Luna の全単価を一覧にし、リクエストがどう課金されるかを説明したうえで、前提条件を明記した 5 つのコストシナリオを計算します。ご自身のトークン数で計算し直せるようにしています。
要点まとめ
- Standard 単価(1M トークンあたり): 入力 $0.10、キャッシュ入力 $0.01、キャッシュ書き込み $0.125、出力 $0.50[1]。
- 入力が 272K トークンを超える場合、リクエスト全体が入力 $0.20、キャッシュ入力 $0.02、キャッシュ書き込み $0.25、出力 $0.75 になります[1][2]。
- Batch と Flex は Standard の半額、Fast モードは 2 倍、リージョン処理は 10% 増しです[2]。
- 推論トークンは出力として課金されるため、利用量の次にコストを大きく動かすのは推論レベル(reasoning effort)です[3]。
- 短いリクエストは安価: 入力 500、出力 10 トークンなら Standard 単価で $0.000055、同じリクエスト 100 万件で $55 です(当社による計算、詳細は後述)。
- GPT-6 の他モデルとの比較: Astra の Standard 単価は Luna のちょうど 100 倍、GPT-6 Sol の入力と出力は 20 倍です[1]。
トークン種別ごとの GPT-6 Luna API 料金
OpenAI は GPT-6 Luna の料金をトークンの種類とプロンプトの長さで分けています。「短いコンテキスト」は入力 272K トークンまでで、それを超えるとリクエスト全体に長コンテキスト単価が適用されます[1]。
| 1M トークンあたり(Standard) | 入力 272K まで | 入力 272K 超 |
|---|---|---|
| 入力 | $0.10 | $0.20 |
| キャッシュ入力 | $0.01 | $0.02 |
| キャッシュ書き込み | $0.125 | $0.25 |
| 出力 | $0.50 | $0.75 |
出典:OpenAI API 料金ページ、Standard ティア[1]。
モデルページには、これらの数字の元になる倍率が書かれています。キャッシュ入力は非キャッシュ入力単価の 10%、キャッシュ書き込みは 1.25 倍で、入力が 272K トークンを超えるプロンプトは「リクエスト全体について、入力とキャッシュの単価が 2 倍、出力が 1.5 倍で課金される」とされています[2]。
Batch、Flex、Fast とリージョン処理
処理ティアによって、すべての単価が一定の倍率で変わります。OpenAI のモデルページには「Batch と Flex は Standard 単価の 50% で課金されます。Fast モードは適用される単価の 2 倍で課金されます」とあり、リージョン処理は「利用可能な場合、10% の割増が加算される」とされています[2]。
| 1M トークンあたり、入力 272K まで | 入力 | キャッシュ入力 | キャッシュ書き込み | 出力 |
|---|---|---|---|---|
| Standard | $0.10 | $0.01 | $0.125 | $0.50 |
| Batch | $0.05 | $0.005 | $0.0625 | $0.25 |
| Flex | $0.05 | $0.005 | $0.0625 | $0.25 |
| Fast | $0.20 | $0.02 | $0.25 | $1.00 |
出典:OpenAI API 料金ページ、Standard・Batch・Flex・Fast の各表[1]。
Batch は夜間の一括分類やバックフィルのようなオフライン処理に向いています。Fast モードはレイテンシが重要なトラフィック向けの OpenAI のオプションですが、OpenAI によると GPT-6 Luna では EU データレジデンシーと併用できません[4]。
GPT-6 Luna のリクエストはどう課金されるか
入力 272K トークン以下のプロンプトを Standard 単価で計算する場合:
cost = ( uncached_input × 0.10
+ cached_input × 0.01
+ cache_write × 0.125
+ output × 0.50 ) / 1,000,000入力が 272K トークンを超える場合は、リクエスト全体について 0.20、0.02、0.25、0.75 に置き換えます。各トークンがどの区分に入るかは、次の 4 つのルールで決まります。
推論トークンは出力です。 OpenAI によると、推論トークンは「モデルのコンテキストウィンドウの領域を占有し、出力トークンとして課金されます」[3]。GPT-6 Luna は none から max までの 6 段階の推論レベルに対応し、デフォルトは medium です[2]。2 単語の分類ラベルの裏に、課金対象の推論トークンが数百個ついていることもあります。
キャッシュ料金は入力単価に上乗せされるのではなく、置き換わります。 OpenAI のキャッシュガイドには、キャッシュ書き込みの料金は「追加料金ではありません。入力トークンには、非キャッシュ入力、キャッシュ入力、キャッシュ書き込みのいずれかの単価が適用されます」とあります[5]。
短いプレフィックスはキャッシュされません。 GPT-5.6 以降のモデルでは、キャッシュ可能なプロンプトの最小長は 1,024 トークンで、キャッシュされたプレフィックスは最後の書き込みまたは再利用から少なくとも 30 分間は有効です[5]。
272K の境界はリクエスト単位です。 入力 300K トークンのプロンプト 1 件は、出力も含めてすべて長コンテキスト単価で課金されます[2]。
GPT-6 Luna API コスト計算:5 つの計算例
以下の各行は、上記の OpenAI の公表単価を使っています。トークン数は説明のために選んだ仮定であり、実測値ではありません。ご自身のレスポンスの usage オブジェクトに出る数字に置き換えてください。
| シナリオ | 前提 | 計算 | 合計 |
|---|---|---|---|
A. チケットのタグ付け、推論レベル none | 1,000,000 リクエスト × 入力 500、出力 10 | 500M × $0.10 + 10M × $0.50 = $50 + $5 | $55.00 |
B. 同じ処理、推論レベル medium | A と同じ、加えてリクエストごとに推論トークン 300 と仮定 | 500M × $0.10 + 310M × $0.50 = $50 + $155 | $205.00 |
| C. シナリオ A を Batch で実行 | A と同じ、Batch 単価 | 500M × $0.05 + 10M × $0.25 = $25 + $2.50 | $27.50 |
| D. キャッシュ済みプレフィックスを使うサポートアシスタント | 100,000 リクエスト。4,000 トークンの固定プレフィックスを 1,000 回書き込み、99,000 回読み取り。各リクエストで新規入力 1,000、出力 400 トークン | 396M × $0.01 + 4M × $0.125 + 100M × $0.10 + 40M × $0.50 = $3.96 + $0.50 + $10 + $20 | $34.46 |
| E. 長文ドキュメント | 1,000 リクエスト × 入力 400,000、出力 2,000(長コンテキスト枠) | 400M × $0.20 + 2M × $0.75 = $80 + $1.50 | $81.50 |
ここから読み取れるポイントは 3 つです。
この例では、利用量より推論レベルのほうがコストに効きます。 B では、仮定した推論処理によって出力トークンが請求額の大半を占め、シナリオ A の 3.7 倍のコストになります。medium に支払う前に、none や low で精度目標を満たせるか試してください。
キャッシュでシナリオ D のコストは半分になります。 キャッシュなしでは、同じトラフィックのコストは 500M × $0.10 + 40M × $0.50 = $70.00 です。キャッシュ読み取りにより、プレフィックス部分は書き込みを含めて $40 から $4.46 に下がります。
272K の境界を超えると入力単価が 2 倍になります。 E の各ドキュメントを、それぞれ出力 2,000 トークンの 200,000 トークンのリクエスト 2 件に分割できれば、請求額は 400M × $0.10 + 4M × $0.50 = $42.00 になります。ただし分割するとモデルが一度に見る内容が変わるため、節約を狙う前に品質を確認してください。
GPT-6 Luna と他の GPT モデルの料金比較
いずれも入力 272K トークンまでのプロンプトにおける、1M トークンあたりの Standard 単価です[1]:
| モデル | 入力 | キャッシュ入力 | キャッシュ書き込み | 出力 |
|---|---|---|---|---|
| GPT-6 Luna | $0.10 | $0.01 | $0.125 | $0.50 |
| GPT-5.6 Luna | $0.20 | $0.02 | $0.25 | $1.20 |
| GPT-6 Sol | $2.00 | $0.20 | $2.50 | $10.00 |
| GPT-6.1 Sol | $2.00 | $0.10 | $2.50 | $10.00 |
| GPT-6 Astra | $10.00 | $1.00 | $12.50 | $50.00 |
OpenAI は Luna の低価格を「キャッシュと推論の改善」によるものとし、GPT-5.6 の料金からの値下げとして還元したと説明しています[6]。モデルごとのトレードオフは GPT-6 Luna vs 5.6 Luna と GPT-6 Sol vs Luna で、Sol 自体の単価は GPT-6 Sol の料金 で扱っています。
reAPI で GPT-6 Luna を利用する場合の支払い
reAPI は GPT-6 Luna を Chat Completions エンドポイントでモデル id gpt-6-luna として提供しており、reAPI のクレジット残高からトークン単位で課金されます。入力、出力、キャッシュ読み取り、キャッシュ書き込みにはそれぞれ別の単価があり、推論トークンは出力として課金され、入力が 272K トークンを超えるプロンプトはリクエスト全体の単価が切り替わります[7]。各レスポンスの usage オブジェクトには prompt_tokens、completion_tokens(推論を含む)、cached_tokens が返されるので、上の式で請求額を照合できます[7]。
reAPI の現在のトークン単価と、入力・出力トークンのコスト見積もりツールは GPT-6 Luna モデルページ にあります。リクエスト形式について 1 点注意があります。GPT-6 Luna に temperature を送ると 400 が返ります。詳しくは GPT-6 Luna temperature をご覧ください。
よくある質問
chat gpt 6 の料金はいくら?
API では、GPT-6 はモデルごとにトークン単位で課金されます。1M トークンあたり、GPT-6 Luna は入力 $0.10・出力 $0.50、GPT-6 Sol と GPT-6.1 Sol は $2 と $10、GPT-6 Astra は $10 と $50 です[1]。ChatGPT では、OpenAI は GPT-6 Sol と Luna を Plus、Pro、Business、Enterprise、Edu のユーザーに提供しており、Free と Go のユーザーはデスクトップアプリで GPT-6 Luna を使えます[6]。
gpt 6 luna 10000 tokens の料金
Standard 単価では、入力 10,000 トークンが $0.001、出力 10,000 トークンが $0.005 です[1]。その入力 10,000 トークンがキャッシュ読み取りなら、$0.0001 になります。
gpt 6 luna 出力トークンの料金
Standard 単価で、入力 272K トークンまでのプロンプトでは出力 1M トークンあたり $0.50、それを超えると $0.75 です[1]。推論トークンは課金対象の出力に含まれます[3]。
gpt 6 luna 料金の割引
OpenAI が挙げているのは 2 つです。Batch と Flex は Standard 単価の 50%、キャッシュ入力は非キャッシュ入力単価の 10% です[2]。Fast モードとリージョン処理は逆に、2 倍と +10% になります。
gpt 6 luna は無料?
API では、GPT-6 Luna は上記の単価でトークン単位に課金されます[1]。ChatGPT では、OpenAI によると Free と Go のユーザーはデスクトップアプリで GPT-6 Luna を利用できます[6]。
gpt 6 luna api のコスト vs gpt 6 astra
GPT-6 Astra の Standard 単価は 1M トークンあたり入力 $10、キャッシュ入力 $1、キャッシュ書き込み $12.50、出力 $50 で、いずれも GPT-6 Luna の各単価のちょうど 100 倍です[1]。Astra にはさらに高価格の Ultrafast ティアもありますが、その表に Luna は載っていません[1]。
GPT API の料金はいくら?
モデルによって異なります。OpenAI の現在の Standard 料金表では、GPT-6 Luna の 1M トークンあたり入力 $0.10・出力 $0.50 から、GPT-5.5 Pro と GPT-5.4 Pro の入力 $30・出力 $180 まで幅があります[1]。
GPT-6 Luna のコストを予測可能にする
GPT-6 Luna の請求額の大部分は、3 つの選択で決まります。送信する推論レベル、固定のプロンプトプレフィックスがキャッシュされるだけの長さがあるか、そして 272K 入力トークンを超えるプロンプトがあるかどうかです。トラフィックのサンプルで実際の usage データからそれぞれを計測し、その数字を式に当てはめてください。そうすれば GPT-6 Luna API の料金は簡単に予測できます。入力 $0.10、出力 $0.50、例外はすべて明記されています。
参考資料
- OpenAI. API pricing. 2026年10月取得:developers.openai.com/api/docs/pricing
- OpenAI. GPT-6 Luna model page. 2026年10月取得:developers.openai.com/api/docs/models/gpt-6-luna
- OpenAI. Reasoning models. 2026年10月取得:developers.openai.com/api/docs/guides/reasoning
- OpenAI. Fast mode. 2026年10月取得:developers.openai.com/api/docs/guides/fast-mode
- OpenAI. Prompt caching. 2026年10月取得:developers.openai.com/api/docs/guides/prompt-caching
- OpenAI. Introducing GPT-6 Sol and Luna. 2026年10月取得:openai.com/index/introducing-gpt-6-sol-and-luna
- reAPI. GPT-6 Luna API docs. 2026年10月取得:reapi.ai/docs/gpt-6-luna
著者

カテゴリ
他の記事

GPT-5.5の使い方:エージェント型の強みと唯一の弱点
GPT-5.5の使い方を詳しく解説。Terminal-Benchでの首位獲得、見た目より小さい価格上昇の実態、誰も言及しない86%幻覚率、そして必要な検証ループについて。


Gemini 4 Argon vs GPT-6 Astra vs Opus 5.5 ベンチマーク比較
Gemini 4 Argon・GPT-6 Astra・Claude Opus 5.5 を Google の表にある全18ベンチマークで比較。出力上限、料金、用途別にどのモデルを選ぶべきかも解説します。


Gemini Omni API:プレビュー仕様・料金・制限事項
Googleの Gemini Omni API プレビュー解説:モデルID、Interactions API、720p出力、課金ルール、入力制限、マルチターン編集、reAPIとの違い。
