
Claude Fable 5.1は安い?キャッシュ料金の実際
Claude Fable 5.1はFable 5の$10/$50料金を維持しますが、キャッシュ読み取りは$0.25に低下。実際のタスク原価と、プラン利用分をごっちゃにしない計算方法。
Claude Fable 5.1はClaude Fable 5より安くはありません。見出し料金では、どちらも入力トークン当たり$10/百万、出力トークン当たり$50/百万です。でも節約幅は絞られていて、かつ大きな可能性があります。Fable 5.1のキャッシュ読み取りは1百万トークルあたり$0.25、Fable 5では$1です。キャッシュ書き込みはどちらも同じ料金です。[1]
この節約が、すべてのタスクを安くする保証ではありません。キャッシュヒットが少なく、出力が長く、ツール呼び出しが多く、努力レベルが高いタスクは、移行後も同じか高くなる可能性があります。また、Claudeの有料プランの利用分メーターが75%減るわけでもありません。プランの利用分とAPI課金は別のシステムです。利用予定のClaude Fable 5.1モデルページで確認し、スプレッドシートにコピーした見出し数ではなく、実際のルートの使用履歴で計算してください。
簡潔な答え
- Fable 5.1はFable 5の入力$10/百万トークン、出力$50/百万トークンを維持します。[1]
- 測定可能な割引はキャッシュ読み取り:$0.25/百万トークル、従来は$1/百万。キャッシュ書き込みの料金は変わりません。
- したがって500Kトークンのキャッシュヒットで、出力・ツール・再試行・却下作業を除いて$0.375節約できます。
- このAPI割引を、Claudeプランの利用分減少として読まないでください。プラン利用分とAPI課金は別です。[4]
「安い」は4つの違う数字を指すかもしれません
このリリースについての議論のほとんどは、最低でも2つを混ぜています:
| 数字 | 何を測定するか | キャッシュレート低下で変わるか |
|---|---|---|
| API定価 | ベンダーの1トークル単価 | はい、ですがキャッシュ読み取り категория だけ |
| リクエスト料金 | トークン数 × 適用料金 | はい、キャッシュ読み取りトークンに比例 |
| 完了タスク1つの原価 | リクエスト、再試行、ツール、失敗を含む全試行 | 可能性有;モデル動作と出力長も影響 |
| プラン利用分メーター | Claude / Claude Codeプランの月間枠か消費ポイント | 単純な$0.75/百万トークルの換算では無理 |
最初の2つはAPI利用オブジェクトと料金表から直接計算できます。3番目は、アプリケーションレベルのタスクIDと、完了判定基準が必要です。4番目は、ご自身のClaudeプランの公式ルールが必要です。
誰かが「Fable 5.1は75%安い」と言ったら、どの行かを聞いてください。キャッシュ読み取りのユニット料金だけが75%低下しました。
料金表、並べて比較
下記の価格はすべて、2026年9月7日時点でのAnthropicの直接API定価(米ドル/百万トークル)です。[1]
| トークン種別 | Claude Fable 5 | Claude Fable 5.1 | 変化 |
|---|---|---|---|
| 基本入力 | $10.00 | $10.00 | なし |
| 5分キャッシュ書き込み | $12.50 | $12.50 | なし |
| 1時間キャッシュ書き込み | $20.00 | $20.00 | なし |
| キャッシュヒット/リフレッシュ | $1.00 | $0.25 | −75% |
| 出力 | $50.00 | $50.00 | なし |
| バッチ入力 | $5.00 | $5.00 | なし |
| バッチ出力 | $25.00 | $25.00 | なし |
Fable 5.1のキャッシュ読み取り係数は、基本入力の0.025倍です。Fable 5は通常の0.1倍です。5分書き込みは基本入力の1.25倍;1時間は2倍です。Anthropicは、これらのキャッシュ修飾子とバッチや地域化などの他の修飾子を組み合わせることができると述べています。[1]
例えば、米国のみでの推論実行に限定すると、対応する最近のClaudeモデル上の入力、出力、キャッシュ書き込み、キャッシュ読み取りに1.1倍の係数が加わります。パートナーが運営するクラウドサービスは独自の地域料金を持ちます。コスト計算シートでは、モデル名だけでなく、プロバイダーと推論地域を記録する必要があります。[1]
コスト報告書に含めるべき公式
各トークン数を百万単位で測定してください:
U = キャッシュされていない入力トークン / 1,000,000
W5 = 5分キャッシュに書き込まれたトークン / 1,000,000
W60 = 1時間キャッシュに書き込まれたトークン / 1,000,000
R = キャッシュ読み取りトークン / 1,000,000
O = 出力トークン / 1,000,000直接定価では、Fable 5.1リクエストは:
request_cost_5_1 = 10U + 12.5W5 + 20W60 + 0.25R + 50OFable 5は、キャッシュ読み取りの項だけが変わります:
request_cost_5 = 10U + 12.5W5 + 20W60 + 1.00R + 50Oトークン数が同じならば、節約額は:
saving = 0.75Rわかりやすく言うと、キャッシュ読み取り百万トークルごとに$0.75節約できます。この公式は意図的に条件付きです。モデルの動作はU、R、Oを変更でき、またタスク完了に必要なリクエスト数も変わります。
500Kトークルキャッシュ付きの実例セッション
架空の10リクエストコーディングセッションを考えてください。各リクエストは同じ500,000トークルのリポジトリ接頭辞を見て、20,000トークルの新しい入力を加え、5,000トークルを出力します。最初のリクエストは5分キャッシュエントリを作成;次の9つはそれにヒットします。これは価格の説明であり、測定されたモデルベンチマークではありません。
最初のリクエスト:同じ料金
500K キャッシュ書き込み = 0.5 × $12.50 = $6.25
20K 新規入力 = 0.02 × $10 = $0.20
5K 出力 = 0.005 × $50 = $0.25
最初のリクエスト $6.70両方とも$6.70です。書き込み、新規入力、出力料金が同じだからです。
その後のキャッシュヒット
| 項目 | Fable 5 | Fable 5.1 |
|---|---|---|
| 500K キャッシュ読み取り | $0.500 | $0.125 |
| 20K キャッシュされていない入力 | $0.200 | $0.200 |
| 5K 出力 | $0.250 | $0.250 |
| リクエスト合計 | $0.950 | $0.575 |
9回のヒット全体:
Fable 5 合計 = $6.70 + (9 × $0.950) = $15.250
Fable 5.1 合計 = $6.70 + (9 × $0.575) = $11.875
節約 $3.375削減率は、このシミュレーションセッションで約22.1%です。キャッシュ読み取りレートは75%低下しましたが。変わらないキャッシュ書き込み、新規入力、出力が節約を薄めます。キャッシュ読み取りの割合が大きいセッションはより大きなパーセンテージで節約できます。キャッシュヒットなしは、同じトークン数なら何も節約できません。
キャッシュ書き込みはいつ価値を持つか
キャッシュと、同じトークンを何度も通常入力として送信することを比較してください。
Fable 5.1の5分キャッシュでは、最初の書き込みは通常入力レートの1.25倍の費用がかかり、1ヒットは0.025倍です。初期リクエストと1回の再利用にわたって、安定したプレフィックスの費用は、キャッシュされていない2.0ユニットではなく1.25 + 0.025 = 1.275ユニットです。1キャッシュ読み取りで元が取れます。
1時間エントリの場合、最初の書き込みは2.0ユニット。1読み取りを追加すると2.025、キャッシュなし2回送信より若干高い。2番目の読み取りを追加すると2.05、キャッシュなし3回送信の3.0と比較できます。Anthropicの価格設定ガイドは、5分の期間は1キャッシュ読み取りで、1時間の期間は2で元が取れると述べています。[1]
この算術は、ヒットを前提とします。変わるプレフィックスは、予想される読み取りを新しい書き込みに変えることができます。安定したコンテンツを最初に保ち、変動の可能性のある指示を後に置き、キャッシュ作成と読み取りカウントを監視してください。プロンプトがキャッシュされていると仮定しないでください。Fable 5.1 API ドキュメントはルート固有のリクエスト形状を説明します。請求確認はまだ返された使用フィールドと請求書から来ます。
より安いキャッシュがなぜもっと高い結果になることがあるのか
キャッシュの価格は、複数リクエストジョブの1つの項に過ぎません。移行後にこれらの原因を追跡してください:
出力の長さ
出力は、公開料金で基本入力の5倍のコストがかかります。追加の10,000出力トークンは$0.50です。先ほどの例では、これは500Kキャッシュ読み取り節約$0.375よりも多いです。出力制限を設定し、長さに報いるのではなく有用な完了を採点してください。
ツール呼び出し
Anthropicは、Fable 5.1は状況によっては、Fable 5が独立した呼び出しをバッチするかもしれない場面で、ターンごとに1つのツール呼び出しを発行するかもしれないと述べています。余分なラウンドトリップはキャッシュされたコンテキストを安く再現できますが、新しい指示、ツール結果、出力、レイテンシも追加できます。[3] 全ループをカウントしてください。
努力レベル
Fable 5.1は5つの努力レベルをサポートし、デフォルトはhighです。古い低い設定からxhighやmaxに移動されたタスクは、キャッシュが改善されても、より多くの推論と時間を消費する可能性があります。モデル名だけが唯一の変数として受け入れられた結果で比較してください。[3]
キャッシュ無効化
キャッシュされたプレフィックス、ツール定義、または会話履歴を変更すると、再利用が減少します。Fable 5.1は、保存された思考も、それを生成したプレフィックスにバインドします。不注意な履歴編集は思考を削除し、作業を再開します。Fable 5.1移行チェックリストはこれらの互換性ルールをカバーしています。
失敗と却下される実行
低い1リクエスト当たり料金は、より多くの実行が人間の修正を必要とする場合は役に立ちません。受け入れられたタスク—テスト合格、スキーマ有効、ソース対応、禁止ファイル未変更—を定義し、生のリクエスト数ではなく受け入れられたタスク数で総費用を割ります。
cost_per_accepted_task = total_cost_for_task_cohort / accepted_tasksAnthropicの25%と45%推定の読み方
Anthropicは、Fable 5.1は典型的なトークン課金ワークロードでFable 5より約25%安いコスト、高度にエージェント的な作業では最大約45%節約できるかもしれないと述べています。[2] その発表ノートは、比較は2026年8月の4週間の使用量をデフォルト努力で使用し、「典型的」なミックスはClaude Enterprise、Claude Code、APIトラフィックをカバーしており、エージェント的なミックスはコンテキスト集約的でツール集約的だったと説明します。
これらの数字は有用な計画前提条件であり、請求モデルの代替ではありません。ご自身のキャッシュ読み取り割合は低い可能性があります。新しいモデルはターン数が異なる可能性があります。ゲートウェイはAnthropicの直接APIとは異なる料金表を持つこともあります。これらの推定がベンダー報告として予算提案に記載されているようにラベルを付けてください。
API計算は低下しているがClaude Code使用メーターが低下していない場合は、キャッシュ動作を調査する前に、それらを別の課金システムとして比較してください。メーターはAPI直接トークン請求を公開するのではなく、計画にとどめるまたは使用ポイントルールを適用している可能性があります。
API課金はClaudeプランメーターではありません
Anthropic Help Centerは、Fable 5とFable 5.1は有料Claudeプランで同じように機能すると述べています。[4]
- MaxプランやプレミアムTeamシートレベル、旧Seat型Enterpriseプランのプレミアムシートでは、Fable利用は週間利用制限の50%までに含まれます。他のClaudeモデルより速く消費されます。Fable制限後、ユーザーはモデルを切り替えるか、使用ポイントで続行できます。
- ProプランとStandardチームシートでは、Fable 5と5.1は、計画に含まれる利用ではなく従量課金ポイントを使用します。
- Seat型Enterpriseの標準シートは組織が有効化された使用ポイント必要。
- 利用量ベースのEnterpriseとClaude APIは標準API料金で請求されます。
早期プロモーションは、一部のFable 5使用を週間制限内で許可し、2026年7月19日に終了し、Fable 5.1には適用されませんでした。古い投稿やスクリーンショットはもはや適用されないルールを説明する可能性があります。[4]
実際上の区別は簡単です。API請求はトークン種別を公開し、料金表で乗算できます。ClaudeやClaude Codeプランメーターはプランポリシーと使用割当を表しています。Anthropicがそのアカウントと表面の正確な変換を公開しない限り、1つから他方を逆エンジニアリングしようとしないでください。
FAQ
Claude Fable 5.1はFable 5より75%安いですか?
そのキャッシュ読み取りユニット料金だけが75%低いです。基本入力、キャッシュ書き込み、出力は同じ料金を保持します。総節約は、すべての変わらない項とモデル動作の変更を考慮した後のキャッシュ読み取り削減に等しいです。
プロンプトキャッシュを使用しない場合、お金を節約できますか?
トークン数が同じ場合は、公開料金の変化から得られません。Fable 5.1は、出力の長さ、ツール呼び出し、努力、再試行、または受け入れレートによってタスクコストを変更できる可能性がありますが、これらはリストプライス削減ではなくワークロード結果です。
自動プロンプトキャッシングは無料ですか?
いいえ。キャッシュ作成、キャッシュ読み取り、通常入力には別々の費用があります。自動キャッシングは、ブレークポイントの管理方法を変更します。キャッシュ書き込み費用は削除しません。[1]
キャッシュリフレッシュはより低いFable 5.1レートを使用しますか?
AnthropicのテーブルはFable 5.1の100万トークルあたり$0.25でキャッシュヒットとリフレッシュをグループ化しています。リクエスト数だけからリフレッシュを推定するのではなく、応答と請求報告書の関連使用フィールドを確認してください。
バッチはFable 5.1を半価格にしますか?
Anthropicはバッチ入力と出力を両方のFableバージョンの標準レート以下50%と表示しています。キャッシュや他の修飾子スタック可能なので、全体的な混合請求を2で割るのではなく、各トークン種別を計算してください。[1]
切り替え後、Claude Code使用がなぜ減りませんでしたか?
計画メーターはAPI キャッシュ読み取り項目ではなく、単純です。セッションが計画の割当に含まれたか、使用ポイントで請求されたかを最初に識別し、一致するセッションを比較してください。また出力、努力、ツール呼び出し、キャッシュヒット、プロンプトプレフィックスが安定したままかどうか確認してください。
デフォルトを切り替える前に実行する請求テスト
最低1つの通常請求サイクルをエクスポートし、アプリケーションタスクIDでリクエストをグループ化してください。各モデルについて、キャッシュされていない入力、5分書き込み、1時間書き込み、キャッシュ読み取り、出力、再試行、および受け入れられたタスクを合計してください。古いトークン量を新しい料金表で再価格設定して、キャッシュ割引を分離してください。その後、この推定と実際のFable 5.1量を比較して、動作変更を公開してください。
再価格設定された推定が低いが観察されたタスク費用が高い場合、キャッシュ割引が機能しており、ワークロード形状が変更されました。この調査結果は「安い」という言葉について言い張るより有用です。それは直接、出力成長、失われたキャッシュヒット、追加ターン、または失敗した作業を示します。
参考資料
- Anthropic, API pricing, accessed September 7, 2026.
- Anthropic, Introducing Claude Fable 5.1 and Mythos 5.1, September 1, 2026.
- Anthropic, Migrating to Claude Fable 5.1 and Claude Mythos 5.1, accessed September 7, 2026.
- Anthropic Help Center, Claude Fable models on your plan, accessed September 7, 2026.
著者

カテゴリ
他の記事

ひとつの商品写真を複数シーンのAI動画広告に変える
クリエイティブブリーフ、ショットカード、参照ルール、プロンプト、APIの例とQAチェックで、商品写真を計画的な複数シーンのAI動画広告に変換します。


Mammouth.aiの代替おすすめ5選|2026年比較
2026年のMammouth.ai代替を検討中ですか。Poe、Perplexity、OpenRouter、HuggingChat、reAPIの5つを、対応モデル・チャット以外の機能・アプリかAPIかという使い方の違いで比較します。


スマートフォンのカメラモーション参照でAI動画を操る方法
スマートフォンで自然なカメラムーブを記録して参照に変換し、3Dアニメーションなしで、その参照データでAI動画モデルにカメラ動作を正確に指示する方法を解説します。
