
Claude Opus 4.8 是什么?跑分、价格与 API 调用方式
Claude Opus 4.8 是 Anthropic 面向复杂推理与 agentic coding 的模型。本文讲清它相比 Opus 4.7 改了什么、官方 benchmark 成绩、每百万 token 的价格,以及如何用 OpenAI 兼容 API 调用。
Anthropic 在 2026 年 5 月 28 日发布了 Claude Opus 4.8,这是 Opus 4.7 的升级版,官方自己的说法是提升幅度不大但确实能感知到[1]。它是 Anthropic 目前处理复杂推理和长周期 agentic coding 能力最强的模型,价格与被它取代的那一代持平。这次真正的看点不是 benchmark 跳了多少,而是可靠性:对于自己写出来的代码,Claude Opus 4.8 放过其中缺陷、不加任何提示的概率大约只有 Opus 4.7 的四分之一[1]。
本文说明 Claude Opus 4.8 是什么、相比 4.7 改了哪些地方、官方公布的 benchmark 成绩、价格,以及怎么通过 OpenAI 兼容 API 调用它。下面所有数字都来自 Anthropic 自己的发布公告、模型总览页和价格页,抓取时间为 2026 年 5 月 30 日。
Claude Opus 4.8 是什么?
Claude Opus 4.8 是 Anthropic Opus 产品线的最新一代,这条线针对的是最难的推理和 agentic coding 任务。API 标识符是 claude-opus-4-8,不带日期后缀[2]。
核心规格:
- Context window: 1M token,整个窗口都按标准 per-token 价格计费[2]。
- 最大输出: 同步 API 下 128K token,Batch API 加上 beta header 后可以到 300K[2]。
- 输入模态: 文本和图像,输出是文本。支持视觉输入;Anthropic 没有列出音频或视频输入[2]。
- 知识截止时间: 2026 年 1 月[2]。
相比 Opus 4.7 有哪些变化
Anthropic 把 Opus 4.8 定位成在 4.7 基础上往前走一步,而不是把它整个换掉,输入和输出价格都没动[1]。有三处变化比较明显。
- 诚实度。 相比上一代,Opus 4.8 放过自己代码里的缺陷、不主动标记出来的概率约为原来的四分之一,也更愿意直接说明不确定,而不是抛出没有依据的结论[1]。
- Fast mode 更便宜也更快。 fast mode 现在的价格是每百万输入 token $10、每百万输出 token $50,Anthropic 称这比上一代的 fast 档便宜三倍、快 2.5 倍[1]。
- effort 可调。 模型默认跑在
higheffort 上,可以拉到extra或max,在难题上花更多 token 换更好的结果[2]。
Claude Opus 4.8 的核心能力
1M token 的 context window
Opus 4.8 单次请求最多能读一百万 token,装得下一个大型代码库或一整套长文档,而且 900K token 的请求和 9K token 的请求,per-token 单价完全一样[2]。在 Microsoft Foundry 上,这个窗口被限制到 200K[2]。
Agentic coding 与推理
在 Anthropic 公布的对比里,这个模型在 agentic coding 和跨学科推理两项上领先。SWE-Bench Pro 拿到 69.2%,带工具的 Humanity's Last Exam 拿到 57.9%,两项都高于 Opus 4.7[1]。完整数字见下面的 benchmark 表。
effort 控制与自适应思考
Opus 4.8 没有沿用单一的 extended thinking 开关,而是改成自适应思考加一个 effort 档位。默认的 high 够应付大部分活;调到 extra 或 max,是用更多 token 换最难那批任务上的更深推理[2]。
视觉、tool use 与 prompt caching
Opus 4.8 在文本之外还接受图像输入,支持 tool use 和 function calling,也能配合 prompt caching 压低重复上下文的成本[2]。这几样正是搭 agent 需要的基础件:读截图、调工具、在一次会话里扛住长上下文。
Claude Opus 4.8 benchmark 成绩
下面是 Anthropic 自己公布的结果,把 Opus 4.8 和 Opus 4.7、GPT-5.5、Gemini 3.1 Pro 放在一起对比[1]。和任何厂商自跑的 benchmark 一样,这组数字只能当方向性参考,不是中立评测。
| Benchmark | Opus 4.8 | Opus 4.7 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Agentic coding(SWE-Bench Pro) | 69.2% | 64.3% | 58.6% | 54.2% |
| 终端编码(Terminal-Bench 2.1) | 74.6% | 66.1% | 78.2% | 70.3% |
| 推理(Humanity's Last Exam,不带工具) | 49.8% | 46.9% | 41.4% | 44.4% |
| 推理(Humanity's Last Exam,带工具) | 57.9% | 54.7% | 52.2% | 51.4% |
| 计算机操作(OSWorld-Verified) | 83.4% | 82.8% | 78.7% | 76.2% |
| 知识工作(GDPval-AA) | 1890 | 1753 | 1769 | 1314 |
| 金融分析(Finance Agent v2) | 53.9% | 51.5% | 51.8% | 43.0% |
除 Terminal-Bench 2.1 外,Opus 4.8 在每一行都排第一;Terminal-Bench 2.1 上是 GPT-5.5 以 78.2% 领先[1]。
Claude Opus 4.8 价格
价格按每百万 token(MTok)计,与 Opus 4.7 相比没有变化[1][3]:
| 项目 | 价格 / MTok |
|---|---|
| 输入 | $5 |
| 输出 | $25 |
| 缓存读取 | $0.50 |
| 缓存写入(5 分钟) | $6.25 |
| 缓存写入(1 小时) | $10 |
| Batch 输入 | $2.50 |
| Batch 输出 | $12.50 |
| Fast mode 输入 | $10 |
| Fast mode 输出 | $50 |
Batch API 按标准输入输出价格的一半计费,prompt caching 则把重复读取上下文的成本压到每百万 token $0.50[3]。
怎么用上 Claude Opus 4.8
你可以直接找 Anthropic 调 Claude Opus 4.8,也可以通过 reAPI 的 OpenAI 兼容网关按 Anthropic 的标准价调用。实时价格和 playground 在 reapi.ai/models/claude-opus-4-8 这一页。走网关的好处是一个 key、一个客户端打通所有供应商:同一套集成既能调 GPT-5 和 Gemini、也能调 reAPI 的图像和视频模型,同样也能调 Claude Opus 4.8。
把 OpenAI SDK 指向 reAPI,再设置 model:
from openai import OpenAI
client = OpenAI(
api_key="YOUR_REAPI_KEY",
base_url="https://api.reapi.ai/v1",
)
resp = client.chat.completions.create(
model="claude-opus-4-8",
messages=[
{"role": "user", "content": "Refactor this function and explain the change."},
],
extra_body={"group": "default"},
)
print(resp.choices[0].message.content)Anthropic 原生的 /v1/messages 接口同样可用,所以按两种格式写的 SDK 都不用重写就能跑。输入每百万 token $5、输出 $25,和 Anthropic 直接收的价格一致。
哪些场景适合用 Claude Opus 4.8
Opus 4.8 是为「出错代价高、上下文又大」的活准备的:
- Agentic coding。 长周期任务里模型要自己规划、改代码、验证结果,诚实度上的提升能减少悄悄埋下的 bug。
- 大上下文分析。 一次请求读完整个代码库或整套文档,最多一百万 token。
- 用工具的 agent。 需要调用工具、读截图、并在很多步之间保持状态的工作流。
- 高风险推理。 研究、金融分析这类场景,标出不确定要比自信地给一个错答案有用得多。
如果是高并发、低复杂度的调用,通常更小更便宜的模型才是合适选择;Opus 属于「能力比每 token 成本更重要」时才拿出来用的档位。
Claude Opus 4.8 在 2026 年的意义
Opus 4.8 有意思的地方不在某一项 benchmark,而在于 Anthropic 把一整个版本花在可靠性上,降低模型放过自身错误的频率,没有去追排行榜。在 agentic coding 这种模型要跨很多步改真实代码的场景里,这种诚实是会累积的:下游要收拾的隐性 bug 更少。再配上一百万 token 的窗口和更便宜的 fast mode,Opus 4.8 瞄准的显然是那些要造出「自己敢用」的 agent 的团队。
FAQ
Claude Opus 4.8 是什么时候发布的?
2026 年 5 月 28 日,作为 Claude Opus 4.7 的升级版发布,价格不变[1]。
Claude Opus 4.8 的 context window 有多大?
1M token,整个窗口按标准 per-token 价格计费。最大输出是 128K token,走 Batch API 最高 300K[2]。
Claude Opus 4.8 多少钱?
每百万输入 token $5、每百万输出 token $25,缓存读取 $0.50,Batch API 半价[3]。Fast mode 是输入 $10、输出 $50[1]。
Claude Opus 4.8 是多模态模型吗?
它接受文本和图像输入、输出文本,支持视觉。Anthropic 没有为这个模型列出音频或视频输入[2]。
Claude Opus 4.8 和 Opus 4.7 有什么区别?
价格相同,诚实度更高(放过自己代码缺陷的概率约为原来的四分之一),fast mode 更便宜也更快,Anthropic 整套 benchmark 上都有小幅提升[1]。
怎么用 OpenAI SDK 调用 Claude Opus 4.8?
把 OpenAI 客户端指向 https://api.reapi.ai/v1,把 model 设成 claude-opus-4-8,然后发一个普通的 chat 请求。reAPI 通过 OpenAI 兼容端点按 Anthropic 的标准价提供 Claude。
一句话总结
Claude Opus 4.8 是一次幅度不大但实打实的升级:价格和 Opus 4.7 一样,一百万 token 上下文,以及一个明确押在诚实度上的取舍,而这一点在 agentic coding 里最有价值。如果你在做会改代码、或者要在大上下文上做推理的 agent,Claude Opus 4.8 就是 Anthropic 产品线目前的顶端,而且可以和你调的其他模型一样,通过 OpenAI 兼容 API 访问。
Further reading
- reapi.ai/docs/claude-opus-4-8 — 端点参考与 SDK 示例。
- What is reAPI? — 用一个 key 打通 chat、图像和视频的统一 API。
- reapi.ai/models — 浏览完整模型目录。
References
- Anthropic. Introducing Claude Opus 4.8. Retrieved May 2026 from anthropic.com/news/claude-opus-4-8
- Anthropic. Models overview — context, output, modality, and capabilities. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/models/overview
- Anthropic. Pricing — token, cache, and batch rates. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/pricing
作者

分类
更多文章

reAPI 是什么?2026 年模型、价格与使用方法
reAPI 是一个兼容 OpenAI 的 API,可访问 200+ 个图片、视频、音频和聊天模型。了解其功能、价格以及首次调用方法。


reAPI 能做什么?图像、视频与 LLM 应用场景
reAPI 目前能做什么?通过一个 OpenAI 兼容 API 调用图像、视频、音频和聊天模型,并了解实际用例、平台对比与接入清单。


2026 年最佳 Replicate 替代方案:5 个选择对比
正在寻找 2026 年的 Replicate 替代方案?从模型范围、价格、速度和 API 设计对比 fal.ai、Together AI、RunPod、Hugging Face 与 reAPI。
