Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 秒あたり

Kimi K3 — 1M コンテキスト、オープンウェイトの旗艦

Kimi K3 は、長時間にわたるコーディングとエンドツーエンドのナレッジワークのための Moonshot の旗艦モデルです。Kimi K3 は 1,048,576 トークンのコンテキストウィンドウを読み、常に推論し、low から max までの 3 段階の reasoning-effort ダイヤルを備えます。ネイティブのビジョンは画像と動画の両方を対象とし、重みは公開されています。reAPI では、Kimi K3 の入力・出力いずれの単価も Moonshot 公表レートを下回ります。

モデルの特徴
Moonshot フラッグシップ · ツール呼び出し · JSON 出力
主な用途
長文脈 zh / en 作業、エージェント
入力
チャットメッセージ(OpenAI 互換)
出力
テキスト、オプションでストリーミング
Kimi K3modelkimi-k3

Kimi K3 プレイグラウンド

チャットモデルは api.reapi.ai ゲートウェイで動作し、専用のコンソールと専用のキーを持ちます。コンソールを開けば、OpenAI 互換の Chat Completions 経由で Kimi K3 を実行できます。

Kimi K3 API とは?

Kimi K3 は、長期にわたるコーディングと知識労働全般に向けた Moonshot AI のオープンウェイト・フラッグシップモデルで、reAPI では OpenAI 互換の chat completions エンドポイントとして提供されます。コンテキストウィンドウは 1,048,576 トークンで、1 回の応答でその全長まで出力でき(デフォルトの出力上限は 131,072 トークン)、推論は常時オンで low・high・max の 3 段階から強度を選べます。画像と動画のネイティブ入力、ツール呼び出し、厳密な JSON Schema 出力にも対応。課金は入力トークンと出力トークンで別々の 100 万トークン単価、同じプレフィックスの再送にはコンテキストキャッシュが自動で効きます。

このモデルで作れるもの

このモデルで構築して本番に出せる、実際のワークフローとユースケースをご紹介します。

崩れたページのスクリーンショットからレイアウト不具合を修正する Kimi K3

スクリーンショットをループに組み込んだ長時間コーディング

Moonshot は Kimi K3 を長時間のコーディングに位置づけ、人間の監督を最小限にしたままエンジニアリング作業を進める姿を描いています。大規模なコードベースを読んで手を入れ、ターミナルのツールを組み合わせて動かす、という姿です。Kimi K3 がテキスト専用のコーディングモデルと違うのは、ビジョンが後付けではなくネイティブだという点です。スクリーンショットや視覚的なフィードバックを入力として受け取り、Moonshot はゲーム開発、フロントエンドエンジニアリング、CAD を具体的に挙げています。これはテキスト専用のモデルには閉じられないループを閉じます。モデルは自分が作ったものを一度見て、次の編集に入る前にレイアウトが本当に崩れているのかを判断できるからです。

API ドキュメントを読む
大量の文書を読み、構造化された成果物を作成する Kimi K3

チャンク分割レイヤーなしの 100 万トークンのナレッジワーク

Kimi K3 のコンテキストウィンドウは 1,048,576 トークンで、Moonshot 自身の FAQ は料金がフラットでコンテキスト長による段階分けがないと明言しています。つまりウィンドウを埋めても、1 トークンあたりのコストは他と変わりません。契約書一式、リサーチ資料、1 年分の開示書類がまるごと Kimi K3 に渡せるので、小さなコンテキストを回避することだけが仕事だった検索レイヤーは不要になります。繰り返しの部分はコンテキストキャッシングが引き受けます。Kimi K3 では自動で、キャッシュ ID も TTL も追加パラメータも要りません。安定したプレフィックスの後ろに変化する質問を置く、というのが設計すべき形です。

途中でツールが読み込まれるエージェントループを実行する Kimi K3

説得されて呼ぶのではなく、呼ばされるエージェント

この世代で 2 つのツール呼び出し制御が入りました。required の tool choice はそのターンで少なくとも 1 回の呼び出しを強制します。調べに行くべき場面でエージェントが記憶から答えてしまうのを止める方法がこれです。K2 系のモデルはこの値を拒否しますが、Kimi K3 は受け付けます。さらに、会話の途中でツールを導入できます。完全な定義を system メッセージに入れるだけなので、大量のツール在庫を毎回のリクエストで前もって宣言する必要はありません。構造化出力と JSON Schema は、ループの最後に Kimi K3 が返すものをパース可能に保ちます。

料金

クレジット制 — 1クレジット = 0.001 USD。完了した生成のみお支払いいただきます。

初回テストコスト
$2.52,500 credits

最安ティアで 1 回生成(1M tokens)。

テスト予算ガイド
クレジット追加
$10
約 4 回のテスト
$50
約 20 回のテスト
$100
約 40 回のテスト
モデルカテゴリ料金
トークン課金入力
$2.5
1M tokens
出力
$12
1M tokens

reApiを選ぶ理由

公表レートを両方向で下回る

Moonshot は Kimi K3 の入力と出力について 100 万トークンあたりの単価を公表しています。reAPI では Kimi K3 はその両方を下回り、出力については丸ごと 5 分の 1 下回ります。裏にサブスクリプションはなく、最低利用額もなく、ゲートウェイ残高から USD 建ての従量課金です。正確な数値は本ページの料金表にあります。

OpenAI 互換でそのまま差し替え

Kimi K3 は標準の `/v1/chat/completions` エンドポイントから提供され、Moonshot 自身の quickstart もこのモデルを OpenAI SDK で動かしています。つまりこの互換性はベンダー側の設計で、こちらが被せた薄皮ではありません。Kimi K3 の採用は base URL とキー、そして model 文字列だけの話です。SDK の入れ替えは不要で、Kimi K3 のための専用クライアントも要りません。

Kimi・Claude・GPT・Gemini を 1 本のキーで

Kimi K3 を呼ぶ api.reapi.ai のキーは、Claude、GPT、Gemini の各ファミリーもそのまま呼べます。Kimi K3 をクローズドなフロンティアモデルと直接比べたり、あるプロバイダーの調子が悪い時間帯に切り替えたりするのは model 文字列の変更で済み、2 つめの実装・2 つめの請求書・2 組めの資格情報は要りません。

Kimi K3 と Claude Opus 5

reAPI ではこの 2 つのトークン単価はほぼ同じで、そのぶん価格はこの比較でいちばん退屈な部分になります。違うのは形です。Kimi K3 は重みが公開され、常に推論し、その推論テキストを返し、動画入力を受け取るモデル。Claude Opus 5 は effort の刻みがより細かく、推論を自分の内に留めるクローズドなモデルです。このうち 2 行が、他社から持ち込んだコードを壊す箇所です。Kimi K3 では思考をオフにできず、その推論テキストはマルチターンの履歴で返し続ける必要があります。

能力
reAPI 上の Kimi K3
Claude Opus 5
重み
公開 — Moonshot は 3 兆パラメータ級で初のオープンソースモデルと表現
非公開 — API 経由のみ
コンテキストと出力上限
1,048,576 トークンのコンテキスト。出力は既定 131,072 で、ウィンドウ全体まで引き上げ可能
1M トークンのコンテキスト。最大出力 128k で固定
思考
常時オンで無効化できない — 代わりに effort を下げる
既定でオン。effort が high 以下なら無効化できる
effort の段階
3 段階 — low、high、max — 既定は max
low から max まで 5 段階、既定は high
推論テキスト
回答と並んで返り、次のリクエストに戻す必要がある
生の推論は返らない。要求すれば読みやすい要約
視覚入力
画像と動画。base64 かアップロード済みファイルで — 公開 URL は拒否
画像と PDF。動画入力なし

比較は執筆時点で各ベンダーが自ら文書化している挙動に基づきます。レートは金額ではなく関係として記述しています。Kimi K3 の実際の数値は上の料金表にあります。

3 ステップで Kimi K3 を本番へ

  1. step 01

    api.reapi.ai でアカウントとキーを作成

    api.reapi.ai でサインアップし、コンソールを開いて API キーを生成します。この 1 本のキーで Kimi K3 とゲートウェイ上の他のすべてのモデルに届き、課金は単一の残高からまとめて行われます。

    開く
  2. step 02

    クライアントをゲートウェイに向ける

    base URL を api.reapi.ai に、キーを今作ったものに設定します。すでに OpenAI Chat Completions を話しているクライアントはそのまま動作し、Kimi K3 に届くのに SDK の入れ替えは不要です。

    開く
  3. step 03

    model に `kimi-k3` を送る

    model フィールドを `kimi-k3` にして messages を POST します。長い出力ではストリーミングを有効にし、これまで送っていた temperature や top_p はすべて外し、推論の effort を選んでください。Kimi K3 は常に考え、既定の段階は最も高価なものです。

    開く
docs/api/kimi-k3

APIリファレンス

そのまま使えるコードと完全なパラメータ一覧。

curl https://api.reapi.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "group": "default",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "high",
    "stream": true
  }'

パラメータ検証エラー

送信時に同期的に拒否され、問題のフィールドが示されます。列挙値・範囲・URL フィールドを確認してください。課金は発生しません。

認証または残高の問題

401 は Bearer キーの欠落または無効、402 は仮押さえ額が残高を超過。キーとクレジットはコンソールで管理できます。

コンテンツまたは素材の拒否

参照素材と生成結果は自動審査を通過します。拒否されたタスクは明確なエラーで失敗し、全額返金されます。

タスクの失敗またはタイムアウト

失敗状態に達したタスクは課金されません。仮押さえは自動返金されます。タスク ID を保持して再試行してください。

よくある質問

このモデルに関するよくある質問。

Kimi K3 は api.reapi.ai の残高からトークン単位で USD 建ての従量課金となり、入力と出力は別レート、サブスクリプションはありません。どちらも Moonshot 公表レートを下回り、出力は丸ごと 5 分の 1 下回ります。現在の数値は本ページの料金表にあります。

start building

リリースの準備はできましたか?

プレイグラウンドで試すか、APIキーを取得して今すぐ統合しましょう。