
MiniMax
MiniMax M3
〜から $0.600 100 万トークンあたり
入力欄のプロンプトから始めるか、例を選んでください。
DeepSeek V4 は DeepSeek 最新世代のオープンウェイトモデルで、reAPI では OpenAI 互換の /v1/chat/completions エンドポイント 1 つで 2 つのバリアントを提供します。高速・低コストな日常業務向けの deepseek-v4-flash(総パラメータ 284B / アクティブ 13B の MoE)と、フロンティア級の推論やエージェント型コーディング向けの deepseek-v4-pro(総パラメータ 1.6T / アクティブ 49B の MoE)です。どちらも 1M トークンのコンテキストウィンドウを読み、1 回あたり最大 384K トークンを返し、デフォルトで思考してから回答し、画像入力・ツール呼び出し・コンテキストキャッシュにも対応します。課金は 1M トークンあたりで、入力と出力は別々に価格設定され、キャッシュヒットした入力はより低い単価になります。
このモデルで構築して本番に出せる、実際のワークフローとユースケースをご紹介します。

DeepSeek V4 Pro は DeepSeek V4 API のフラグシップで、エージェント型コーディング・複雑な推論・STEM 向けにチューニングされた 1.6T パラメータの mixture-of-experts モデル(アクティブ 49B)です。DeepSeek はエージェント型コーディングのベンチマークでオープンソース最高水準の結果を報告しており、V4 は Claude Code、OpenClaw、OpenCode などのエージェントハーネスと統合されています。コーディングエージェントを DeepSeek V4 API に向ければ、タスクのスコープを定め、ツールを呼び出し、複数ステップの作業を 1 回の実行で推論しながら進めます。
API ドキュメントを読む
DeepSeek V4 Flash は DeepSeek V4 API の高速レーンで、推論性能が Pro に肉薄しながらコストはわずかな 284B パラメータ(アクティブ 13B)のモデルです。DeepSeek V4 API は、IDE 内のオートコンプリート、インライン候補、CI 段階のコードレビュー、大量のサマリ生成、チャットバックエンドに使えます。コンテキストキャッシュは繰り返されるシステムプロンプトやツールスキーマを低いキャッシュヒット単価に切り詰めるため、エージェントループや大量トラフィックでも安価なまま運用できます。

DeepSeek V4 API の両モデルは、デフォルトで 1M トークンのコンテキストウィンドウを備えます。中規模のリポジトリ全体、長大なリサーチ資料、複数ターンのエージェントトレースを 1 回の呼び出しで読み込むのに十分です。DeepSeek Sparse Attention により長コンテキストの推論が効率的に保たれるため、アーキテクチャレビュー、依存関係の監査、移行計画といった DeepSeek V4 API のワークロードでチャンク分割が必要になることはめったにありません。
クレジット制 — 1クレジット = 0.001 USD。完了した生成のみお支払いいただきます。
最安ティアで 1 回生成(1M tokens)。
| モデル | カテゴリ | 料金 |
|---|---|---|
| DeepSeek V4 Flash | 入力(キャッシュミス) | $0.1 1M tokens |
| 入力(キャッシュヒット) | $0.0028 1M tokens | |
| 出力 | $0.2 1M tokens | |
| DeepSeek V4 Pro | 入力(キャッシュミス) | $0.4 1M tokens |
| 入力(キャッシュヒット) | $0.0145 1M tokens | |
| 出力 | $0.9 1M tokens |
DeepSeek V4 API は OpenAI Chat Completions をそのまま話します。既存の OpenAI 連携を DeepSeek V4 API へ移すのに必要なのは、ベース URL、API キー、そしてモデル文字列の変更(`deepseek-v4-flash` または `deepseek-v4-pro`)だけで、プラットフォームの作り直しではありません。同じ `messages` 配列、同じストリーミング形式に加え、好む利用者向けにネイティブな Anthropic 形式のサーフェスも用意されています。
DeepSeek V4 API はオープンウェイトで、価格もそれに見合っています。Pro は推論・数学・コーディングでトップクラスのクローズドソースモデルに匹敵しながら、トークンあたりのコストはそのわずかな一部です。Flash は日常トラフィック向けにさらに一桁価格を下げます。プレミアムな作業は Pro で実行し、大量の呼び出しは同じキーで Flash にルーティングできます。
1 つの api.reapi.ai キーで、DeepSeek V4 API を GPT-5.5、Claude Opus 4.8、Gemini など、プラットフォーム上のあらゆるフロンティアチャットモデルと並べて利用できます。設定変更だけで、ベンダーを比較し、フォールバックを追加し、呼び出し単位でトラフィックをルーティングできます。連携プロジェクトを起こす必要はありません。
DeepSeek V4 API は V3.2 からの世代を超えた飛躍です。より大きなコンテキストウィンドウ、2 つのモデルティア、デフォルトで有効な思考モード、画像対応、エージェント重視のチューニングを備えます。両者の変更点は次のとおりです。
この比較は、執筆時点での DeepSeek の V4 リリースノートおよびモデルドキュメントで公に記載された挙動を反映しています。一部のベンチマークに関する主張はベンダー報告によるものです。モデルの挙動と価格は変わることがあります。最新の値は上の料金カードと API ドキュメントを確認してください。
api.reapi.ai で登録し、コンソールを開き、API Keys でキーを生成し、Top Up でトークンをチャージします。チャットワークスペースは reapi.ai の画像/動画ゲートウェイとは別物で、キーは相互に使えません。
開くPOST https://api.reapi.ai/v1/chat/completions に対し、`model` を `deepseek-v4-flash`(または `deepseek-v4-pro`)に設定し、`messages` 配列と `max_tokens` を指定して送信します。DeepSeek V4 API のエンドポイントはストリーミングレスポンスを含めて OpenAI 互換で、モデルの切り替えは 1 行の変更で済みます。
開くDeepSeek V4 API では、レイテンシに敏感で高スループットな作業には Flash を、深い推論が必要なタスクには Pro を選びます。安定したシステムプロンプトを再利用して低いキャッシュ読み取り単価を狙い、不要なときは思考モードをオフにして最速・最安の応答を得ます。
開くcurl https://api.reapi.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"group": "default",
"messages": [
{ "role": "user", "content": "Hello" }
],
"stream": true,
"max_tokens": 4096,
"temperature": 0.7
}'送信時に同期的に拒否され、問題のフィールドが示されます。列挙値・範囲・URL フィールドを確認してください。課金は発生しません。
401 は Bearer キーの欠落または無効、402 は仮押さえ額が残高を超過。キーとクレジットはコンソールで管理できます。
参照素材と生成結果は自動審査を通過します。拒否されたタスクは明確なエラーで失敗し、全額返金されます。
失敗状態に達したタスクは課金されません。仮押さえは自動返金されます。タスク ID を保持して再試行してください。
このモデルに関するよくある質問。