
Anthropic
Claude Sonnet 4.6
起 $2.40 每 1M Token
Claude Opus 5 是 Anthropic 面向复杂 agent 编码和企业级任务的模型,通过 OpenAI 兼容的 /v1/chat/completions 接口提供。它给出 100 万 token 上下文窗口、单次最多 128k 输出 token(思考 token 也计入这一额度)、默认开启的自适应思考,以及 low、medium、high、xhigh、max 五档 effort 调节——这一档位取代了采样参数,因为该模型会拒绝 temperature、top_p 和 top_k。计费按百万 token 计算,输入与输出分别定价。
可以用这个模型构建并上线的真实工作流与生产级用例。

Anthropic 把 Claude Opus 5 定位在复杂 Agent 编码与企业级工作上,模型的形态也正好对得上:1M token 的上下文窗口意味着整个仓库、它的测试和 issue 历史可以塞进一次请求,而 128k 的输出 token 足够写出一次多文件改动,而不是一个占位实现。自适应思考默认开启,因此 Claude Opus 5 会在多轮工具调用之间把计划维持住,而不是每一轮都从头开始推理。Anthropic 自家迁移指引给出的实用建议是:一次性把完整的任务说明交给 Claude Opus 5,让它自己跑完,而不是把任务拆成很多轮短交互慢慢透露。
阅读 API 文档
Claude Opus 5 找真 bug 的精确率和召回率都很高,而且在较低努力度下依然准——这让「审查时先跑一遍便宜的快速审查、随后再跑一遍彻底的」成为一种可行模式。有一个值得提前设计的坑:Claude Opus 5 会字面执行关于严重级别的指令。审查 prompt 里写「只报高严重级别的问题」,它就真的只报这些,于是你测出来的召回率反而降了,尽管底层的找 bug 能力是提升的。让 Claude Opus 5 把所有问题连同置信度和严重级别一起报出来,再用单独一遍来过滤。

文本、图片和 PDF 都是 Claude Opus 5 的输入,而百万 token 的窗口大到可以把一整套合同、一整份研究材料或一整年的申报文件整体放进去。那个唯一职责是绕开小上下文的检索层,也就不必存在了。Claude Opus 5 还能生成和编辑带真实公式的多表格电子表格、按设计惯例做幻灯片,需要的时候也可以要求它遵循指定模板。它在图表和高密度文档上的视觉能力足够强,与其单纯提高思考深度,不如给 Claude Opus 5 工具让它裁剪并重新检查自己的产出。
积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。
最低档一次 1K token 提示加 1K token 回答。
| 模型 | 类别 | 价格 |
|---|---|---|
| Token 计费 | 输入 | $2.4 1M tokens |
| 输出 | $12 1M tokens |
Anthropic 为 Claude Opus 5 的输入和输出公布了每百万 token 的价格。在 reAPI 上,Claude Opus 5 两项都不到其一半——底下没有订阅,没有最低消费,按量以美元从你的网关余额扣费。具体数字见本页的价格表。
Claude Opus 5 通过标准的 `/v1/chat/completions` 接口提供。如果你的代码已经在说这套协议,接入 Claude Opus 5 就是一个 base URL、一把 Key 和一个 model 字符串的事——base URL 指向网关之后,原来的 SDK 照旧可用。不用换 SDK,不用写专用客户端。
调用 Claude Opus 5 的那把 api.reapi.ai Key,同样能调用 GPT 与 Gemini 系列。把 Claude Opus 5 和另一个前沿模型做对比,或者在某家厂商状态不好时切走,只是换一个 model 字符串,而不是第二次集成、第二张发票和第二套凭证。
这组对比跟价格无关。Anthropic 为两个模型公布的每 token 单价、一百万 token 上下文窗口和 128k 输出上限完全一致。Claude Opus 5 是在这之上的能力跃迁,同时它悄悄改了两个请求面的默认行为,直接搬过来的代码会因此出错——思考现在默认运行,而关掉它被限制在 high 努力度以内。
对比依据撰写时 Anthropic 自家模型总览页记录的行为。价格只描述关系而不给具体金额;Claude Opus 5 的实时数字见上方价格表。
在 api.reapi.ai 注册,打开控制台生成一把 API Key。这一把 Key 就能访问 Claude Opus 5 和网关上其它所有模型,从同一份余额扣费。
打开把 base URL 设成 api.reapi.ai,Key 换成刚创建的那一把。任何已经在说 OpenAI Chat Completions 的客户端都不用改就能跑——接 Claude Opus 5 不需要换 SDK。
打开把 model 字段设为 `claude-opus-5`,然后 POST 你的 messages。长输出记得打开流式;另外别忘了 Claude Opus 5 默认会思考,所以 max token 里要给推理和答案都留出空间。
打开curl https://api.reapi.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5",
"group": "default",
"messages": [
{ "role": "user", "content": "Hello" }
],
"stream": true,
"max_tokens": 16000
}'提交时同步拒绝并指明出错字段。检查枚举值、范围与 URL 字段——不产生任何扣费。
401 表示 Bearer 密钥缺失或无效;402 表示预扣额超出余额。密钥与积分在控制台管理。
参考素材与生成结果都会经过自动审核。被拒的任务返回明确错误并全额退款。
进入失败状态的任务不会扣费——预扣自动退还。保留任务 ID,随时可重试。
关于此模型的常见疑问。