Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 每秒
Claude Opus 4.8 是什么?跑分、价格与 API 调用方式
2026/05/30

Claude Opus 4.8 是什么?跑分、价格与 API 调用方式

Claude Opus 4.8 是 Anthropic 面向复杂推理与 agentic coding 的模型。本文讲清它相比 Opus 4.7 改了什么、官方 benchmark 成绩、每百万 token 的价格,以及如何用 OpenAI 兼容 API 调用。

Anthropic 在 2026 年 5 月 28 日发布了 Claude Opus 4.8,这是 Opus 4.7 的升级版,官方自己的说法是提升幅度不大但确实能感知到[1]。它是 Anthropic 目前处理复杂推理和长周期 agentic coding 能力最强的模型,价格与被它取代的那一代持平。这次真正的看点不是 benchmark 跳了多少,而是可靠性:对于自己写出来的代码,Claude Opus 4.8 放过其中缺陷、不加任何提示的概率大约只有 Opus 4.7 的四分之一[1]

本文说明 Claude Opus 4.8 是什么、相比 4.7 改了哪些地方、官方公布的 benchmark 成绩、价格,以及怎么通过 OpenAI 兼容 API 调用它。下面所有数字都来自 Anthropic 自己的发布公告、模型总览页和价格页,抓取时间为 2026 年 5 月 30 日。

Claude Opus 4.8 是什么?

Claude Opus 4.8 是 Anthropic Opus 产品线的最新一代,这条线针对的是最难的推理和 agentic coding 任务。API 标识符是 claude-opus-4-8,不带日期后缀[2]

核心规格:

  • Context window: 1M token,整个窗口都按标准 per-token 价格计费[2]
  • 最大输出: 同步 API 下 128K token,Batch API 加上 beta header 后可以到 300K[2]
  • 输入模态: 文本和图像,输出是文本。支持视觉输入;Anthropic 没有列出音频或视频输入[2]
  • 知识截止时间: 2026 年 1 月[2]

相比 Opus 4.7 有哪些变化

Anthropic 把 Opus 4.8 定位成在 4.7 基础上往前走一步,而不是把它整个换掉,输入和输出价格都没动[1]。有三处变化比较明显。

  • 诚实度。 相比上一代,Opus 4.8 放过自己代码里的缺陷、不主动标记出来的概率约为原来的四分之一,也更愿意直接说明不确定,而不是抛出没有依据的结论[1]
  • Fast mode 更便宜也更快。 fast mode 现在的价格是每百万输入 token $10、每百万输出 token $50,Anthropic 称这比上一代的 fast 档便宜三倍、快 2.5 倍[1]
  • effort 可调。 模型默认跑在 high effort 上,可以拉到 extramax,在难题上花更多 token 换更好的结果[2]

Claude Opus 4.8 的核心能力

1M token 的 context window

Opus 4.8 单次请求最多能读一百万 token,装得下一个大型代码库或一整套长文档,而且 900K token 的请求和 9K token 的请求,per-token 单价完全一样[2]。在 Microsoft Foundry 上,这个窗口被限制到 200K[2]

Agentic coding 与推理

在 Anthropic 公布的对比里,这个模型在 agentic coding 和跨学科推理两项上领先。SWE-Bench Pro 拿到 69.2%,带工具的 Humanity's Last Exam 拿到 57.9%,两项都高于 Opus 4.7[1]。完整数字见下面的 benchmark 表。

effort 控制与自适应思考

Opus 4.8 没有沿用单一的 extended thinking 开关,而是改成自适应思考加一个 effort 档位。默认的 high 够应付大部分活;调到 extramax,是用更多 token 换最难那批任务上的更深推理[2]

视觉、tool use 与 prompt caching

Opus 4.8 在文本之外还接受图像输入,支持 tool use 和 function calling,也能配合 prompt caching 压低重复上下文的成本[2]。这几样正是搭 agent 需要的基础件:读截图、调工具、在一次会话里扛住长上下文。

Claude Opus 4.8 benchmark 成绩

下面是 Anthropic 自己公布的结果,把 Opus 4.8 和 Opus 4.7、GPT-5.5、Gemini 3.1 Pro 放在一起对比[1]。和任何厂商自跑的 benchmark 一样,这组数字只能当方向性参考,不是中立评测。

BenchmarkOpus 4.8Opus 4.7GPT-5.5Gemini 3.1 Pro
Agentic coding(SWE-Bench Pro)69.2%64.3%58.6%54.2%
终端编码(Terminal-Bench 2.1)74.6%66.1%78.2%70.3%
推理(Humanity's Last Exam,不带工具)49.8%46.9%41.4%44.4%
推理(Humanity's Last Exam,带工具)57.9%54.7%52.2%51.4%
计算机操作(OSWorld-Verified)83.4%82.8%78.7%76.2%
知识工作(GDPval-AA)1890175317691314
金融分析(Finance Agent v2)53.9%51.5%51.8%43.0%

除 Terminal-Bench 2.1 外,Opus 4.8 在每一行都排第一;Terminal-Bench 2.1 上是 GPT-5.5 以 78.2% 领先[1]

Claude Opus 4.8 价格

价格按每百万 token(MTok)计,与 Opus 4.7 相比没有变化[1][3]

项目价格 / MTok
输入$5
输出$25
缓存读取$0.50
缓存写入(5 分钟)$6.25
缓存写入(1 小时)$10
Batch 输入$2.50
Batch 输出$12.50
Fast mode 输入$10
Fast mode 输出$50

Batch API 按标准输入输出价格的一半计费,prompt caching 则把重复读取上下文的成本压到每百万 token $0.50[3]

怎么用上 Claude Opus 4.8

你可以直接找 Anthropic 调 Claude Opus 4.8,也可以通过 reAPI 的 OpenAI 兼容网关按 Anthropic 的标准价调用。实时价格和 playground 在 reapi.ai/models/claude-opus-4-8 这一页。走网关的好处是一个 key、一个客户端打通所有供应商:同一套集成既能调 GPT-5 和 Gemini、也能调 reAPI 的图像和视频模型,同样也能调 Claude Opus 4.8。

把 OpenAI SDK 指向 reAPI,再设置 model:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_REAPI_KEY",
    base_url="https://api.reapi.ai/v1",
)

resp = client.chat.completions.create(
    model="claude-opus-4-8",
    messages=[
        {"role": "user", "content": "Refactor this function and explain the change."},
    ],
    extra_body={"group": "default"},
)
print(resp.choices[0].message.content)

Anthropic 原生的 /v1/messages 接口同样可用,所以按两种格式写的 SDK 都不用重写就能跑。输入每百万 token $5、输出 $25,和 Anthropic 直接收的价格一致。

哪些场景适合用 Claude Opus 4.8

Opus 4.8 是为「出错代价高、上下文又大」的活准备的:

  • Agentic coding。 长周期任务里模型要自己规划、改代码、验证结果,诚实度上的提升能减少悄悄埋下的 bug。
  • 大上下文分析。 一次请求读完整个代码库或整套文档,最多一百万 token。
  • 用工具的 agent。 需要调用工具、读截图、并在很多步之间保持状态的工作流。
  • 高风险推理。 研究、金融分析这类场景,标出不确定要比自信地给一个错答案有用得多。

如果是高并发、低复杂度的调用,通常更小更便宜的模型才是合适选择;Opus 属于「能力比每 token 成本更重要」时才拿出来用的档位。

Claude Opus 4.8 在 2026 年的意义

Opus 4.8 有意思的地方不在某一项 benchmark,而在于 Anthropic 把一整个版本花在可靠性上,降低模型放过自身错误的频率,没有去追排行榜。在 agentic coding 这种模型要跨很多步改真实代码的场景里,这种诚实是会累积的:下游要收拾的隐性 bug 更少。再配上一百万 token 的窗口和更便宜的 fast mode,Opus 4.8 瞄准的显然是那些要造出「自己敢用」的 agent 的团队。

FAQ

Claude Opus 4.8 是什么时候发布的?

2026 年 5 月 28 日,作为 Claude Opus 4.7 的升级版发布,价格不变[1]

Claude Opus 4.8 的 context window 有多大?

1M token,整个窗口按标准 per-token 价格计费。最大输出是 128K token,走 Batch API 最高 300K[2]

Claude Opus 4.8 多少钱?

每百万输入 token $5、每百万输出 token $25,缓存读取 $0.50,Batch API 半价[3]。Fast mode 是输入 $10、输出 $50[1]

Claude Opus 4.8 是多模态模型吗?

它接受文本和图像输入、输出文本,支持视觉。Anthropic 没有为这个模型列出音频或视频输入[2]

Claude Opus 4.8 和 Opus 4.7 有什么区别?

价格相同,诚实度更高(放过自己代码缺陷的概率约为原来的四分之一),fast mode 更便宜也更快,Anthropic 整套 benchmark 上都有小幅提升[1]

怎么用 OpenAI SDK 调用 Claude Opus 4.8?

把 OpenAI 客户端指向 https://api.reapi.ai/v1,把 model 设成 claude-opus-4-8,然后发一个普通的 chat 请求。reAPI 通过 OpenAI 兼容端点按 Anthropic 的标准价提供 Claude。

一句话总结

Claude Opus 4.8 是一次幅度不大但实打实的升级:价格和 Opus 4.7 一样,一百万 token 上下文,以及一个明确押在诚实度上的取舍,而这一点在 agentic coding 里最有价值。如果你在做会改代码、或者要在大上下文上做推理的 agent,Claude Opus 4.8 就是 Anthropic 产品线目前的顶端,而且可以和你调的其他模型一样,通过 OpenAI 兼容 API 访问。

Further reading

References

  1. Anthropic. Introducing Claude Opus 4.8. Retrieved May 2026 from anthropic.com/news/claude-opus-4-8
  2. Anthropic. Models overview — context, output, modality, and capabilities. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/models/overview
  3. Anthropic. Pricing — token, cache, and batch rates. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/pricing