
Anthropic
Claude Opus 5
起 $2.40 每 1M tokens
可以用这个模型构建并上线的真实工作流与生产级用例。

Moonshot 把 Kimi K3 定位在长程编程上,并且描述它在极少人工监督下推进工程任务——读懂并改动大型代码库、协调终端工具。Kimi K3 与纯文本编程模型的区别在于,视觉是原生的而不是后来贴上去的:它把截图和视觉反馈当作输入,Moonshot 特别点出了游戏开发、前端工程和 CAD 这几个场景。这就闭上了纯文本模型闭不上的那个环,因为模型可以看一眼自己刚做出来的东西,在下一次编辑之前判断布局到底是不是真的错了。
阅读 API 文档
Kimi K3 的上下文窗口是 1,048,576 token,而 Moonshot 自家 FAQ 明确说价格是平的、不按上下文长度分档——所以把窗口填满,每个 token 的成本和其它 token 一样。一整套合同、一整份研究材料或一整年的申报文件可以整体交给 Kimi K3,那个唯一职责是绕开小上下文的检索层也就不必存在了。重复的部分交给上下文缓存:在 Kimi K3 上它是自动的,没有 cache id、没有 TTL、没有额外参数,所以「稳定前缀 + 变化的问题」就是该围绕它设计的模式。

这一代带来了两个工具调用控制项。required 的 tool choice 会强制这一轮至少发生一次调用,这正是防止 Agent 在本该去查资料时凭记忆作答的办法——K2 系列会拒绝这个取值,Kimi K3 接受。另外,工具可以在对话中途引入:把完整定义放进一条 system 消息即可,于是庞大的工具清单不必在每次请求里全部预先声明。结构化输出与 JSON Schema 则保证 Kimi K3 在整个循环末端返回的东西是可解析的。
积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。
| 类别 | 单位 | 价格 |
|---|---|---|
| Token 计费 | ||
| 输入 | 1M tokens | $2.5 |
| 输出 | 1M tokens | $12 |
Moonshot 为 Kimi K3 的输入和输出公布了每百万 token 的价格。在 reAPI 上,Kimi K3 两项都低于它,输出更是低了整整五分之一——底下没有订阅,没有最低消费,按量以美元从你的网关余额扣费。具体数字见本页的价格表。
Kimi K3 通过标准的 `/v1/chat/completions` 接口提供,而 Moonshot 自家 quickstart 本身就是用 OpenAI SDK 调这个模型的——所以这份兼容性是厂商的设计,不是我们套的一层壳。接入 Kimi K3 就是一个 base URL、一把 Key 和一个 model 字符串。不用换 SDK,Kimi K3 也不需要什么专用客户端。
调用 Kimi K3 的那把 api.reapi.ai Key,同样能调用 Claude、GPT 与 Gemini 系列。把 Kimi K3 和某个闭源前沿模型放在一起对打,或者在某家厂商状态不好时切走,只是换一个 model 字符串,而不是第二次集成、第二张发票和第二套凭证。
在 reAPI 上这两者的每 token 单价几乎相同,于是价格反倒是这组对比里最没意思的部分。真正不同的是形态:Kimi K3 是权重开源、始终推理、把推理文本交回给你、并且吃视频输入的那一个;Claude Opus 5 是闭源、努力度阶梯更细、把推理留给自己的那一个。其中两行正是会让从别家照搬过来的代码出错的地方——Kimi K3 的思考关不掉,而它的推理文本必须在多轮历史里回传。
对比依据撰写时各家厂商各自文档记录的行为。价格只描述关系而不给具体金额;Kimi K3 的实时数字见上方价格表。
在 api.reapi.ai 注册,打开控制台生成一把 API Key。这一把 Key 就能访问 Kimi K3 和网关上其它所有模型,从同一份余额扣费。
打开把 base URL 设成 api.reapi.ai,Key 换成刚创建的那一把。任何已经在说 OpenAI Chat Completions 的客户端都不用改就能跑——接 Kimi K3 不需要换 SDK。
打开把 model 字段设为 `kimi-k3`,然后 POST 你的 messages。长输出记得打开流式,把原来在传的 temperature 或 top_p 全部去掉,并且选一个推理努力度——Kimi K3 始终会思考,而默认档位是最贵的那一档。
打开关于此模型的常见疑问。