Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 pro Sekunde
Was ist Claude Opus 4.8? Anthropics neues Modell erklärt
2026/05/30

Was ist Claude Opus 4.8? Anthropics neues Modell erklärt

Claude Opus 4.8 ist Anthropics stärkstes Modell für Reasoning und agentisches Coding. Das ist neu, dazu Benchmarks, Preise und wie du Zugriff bekommst.

Anthropic hat Claude Opus 4.8 am 28. Mai 2026 veröffentlicht, ein Upgrade von Opus 4.7, das der Anbieter selbst als moderate, aber spürbare Verbesserung beschreibt[1]. Es ist Anthropics leistungsfähigstes Modell für komplexes Reasoning und langlaufendes agentisches Coding und startete zum Preis des Vorgängers. Die Schlagzeile ist kein Benchmark-Sprung, sondern Verlässlichkeit: Claude Opus 4.8 lässt einen Fehler im selbst geschriebenen Code rund viermal seltener unkommentiert durchgehen als Opus 4.7[1].

Dieser Leitfaden erklärt, was Claude Opus 4.8 ist, was sich gegenüber 4.7 geändert hat, welche Benchmarks veröffentlicht sind, was es kostet und wie du es über eine OpenAI-kompatible API aufrufst. Alle Zahlen stammen aus Anthropics eigener Ankündigung, der Modellübersicht und den Preisseiten, abgerufen am 30. Mai 2026.

Was ist Claude Opus 4.8?

Claude Opus 4.8 ist das neueste Modell in Anthropics Opus-Linie, der Stufe für die härtesten Reasoning- und Agentic-Coding-Aufgaben. Die API-Kennung lautet claude-opus-4-8, ohne Datumssuffix[2].

Die Eckdaten:

  • Kontextfenster: 1 Mio. Token, über das gesamte Fenster zum Standard-Tokenpreis abgerechnet[2].
  • Maximale Ausgabe: 128K Token über die synchrone API, bis zu 300K über die Batch-API mit Beta-Header[2].
  • Eingabemodalitäten: Text und Bild. Ausgabe ist Text. Vision wird unterstützt; Audio- oder Video-Eingabe listet Anthropic nicht[2].
  • Wissensstand: Januar 2026[2].

Was gegenüber Opus 4.7 neu ist

Anthropic positioniert Opus 4.8 als Weiterentwicklung von 4.7 statt als vollständigen Ersatz und liefert es zum gleichen Ein- und Ausgabepreis[1]. Drei Änderungen stechen heraus.

  • Ehrlichkeit. Opus 4.8 lässt einen Fehler im eigenen Code rund viermal seltener unmarkiert durchgehen als der Vorgänger und weist Unsicherheit eher aus, statt unbelegte Behauptungen aufzustellen[1].
  • Günstigerer, schnellerer Fast Mode. Der Fast Mode kostet jetzt 10 $ pro Million Eingabe-Token und 50 $ pro Million Ausgabe-Token, laut Anthropic dreimal günstiger und 2,5-mal schneller als die Fast-Stufe der Vorgängergeneration[1].
  • Effort-Steuerung. Das Modell steht standardmäßig auf high und lässt sich auf extra oder max heben, um bei harten Problemen mehr Token für bessere Ergebnisse einzusetzen[2].

Kernfähigkeiten von Claude Opus 4.8

Ein Kontextfenster von 1 Mio. Token

Opus 4.8 liest bis zu eine Million Token in einer Anfrage, genug für eine große Codebasis oder einen langen Dokumentensatz, und eine Anfrage mit 900K Token wird zum gleichen Tokenpreis abgerechnet wie eine mit 9K[2]. Auf Microsoft Foundry ist das Fenster auf 200K begrenzt[2].

Agentisches Coding und Reasoning

Das Modell führt in Anthropics veröffentlichtem Vergleich bei agentischem Coding und multidisziplinärem Reasoning. Es erreicht 69,2 % auf SWE-Bench Pro und 57,9 % auf Humanity's Last Exam mit Tools, beides über Opus 4.7[1]. Die vollständigen Zahlen stehen in der Benchmark-Tabelle unten.

Effort-Steuerung und adaptives Denken

Statt eines einzelnen Extended-Thinking-Schalters nutzt Opus 4.8 adaptives Denken plus eine Effort-Einstellung. Der Standard high passt für die meisten Aufgaben; extra oder max tauscht mehr Token gegen tieferes Reasoning bei den schwersten Aufgaben[2].

Vision, Tool-Nutzung und Prompt-Caching

Opus 4.8 nimmt Bild neben Text entgegen, unterstützt Tool-Nutzung und Function Calling und arbeitet mit Prompt-Caching, um wiederholten Kontext günstiger zu machen[2]. Das sind die Bausteine für Agents, die Screenshots lesen, Tools aufrufen und langen Kontext über eine Session tragen.

Benchmarks von Claude Opus 4.8

Das sind Anthropics eigene veröffentlichte Ergebnisse im Vergleich von Opus 4.8 mit Opus 4.7, GPT-5.5 und Gemini 3.1 Pro[1]. Wie bei jedem herstellereigenen Benchmark gilt: als Richtungssignal lesen, nicht als neutrale Prüfung.

BenchmarkOpus 4.8Opus 4.7GPT-5.5Gemini 3.1 Pro
Agentisches Coding (SWE-Bench Pro)69,2 %64,3 %58,6 %54,2 %
Terminal-Coding (Terminal-Bench 2.1)74,6 %66,1 %78,2 %70,3 %
Reasoning (Humanity's Last Exam, ohne Tools)49,8 %46,9 %41,4 %44,4 %
Reasoning (Humanity's Last Exam, mit Tools)57,9 %54,7 %52,2 %51,4 %
Computer-Nutzung (OSWorld-Verified)83,4 %82,8 %78,7 %76,2 %
Wissensarbeit (GDPval-AA)1890175317691314
Finanzanalyse (Finance Agent v2)53,9 %51,5 %51,8 %43,0 %

Opus 4.8 führt in jeder Zeile außer Terminal-Bench 2.1, wo GPT-5.5 mit 78,2 % vorn liegt[1].

Preise von Claude Opus 4.8

Die Preise gelten pro Million Token (MTok) und sind gegenüber Opus 4.7 unverändert[1][3]:

PositionPreis / MTok
Eingabe5 $
Ausgabe25 $
Cache-Lesen0,50 $
Cache-Schreiben (5 Minuten)6,25 $
Cache-Schreiben (1 Stunde)10 $
Batch-Eingabe2,50 $
Batch-Ausgabe12,50 $
Fast Mode Eingabe10 $
Fast Mode Ausgabe50 $

Die Batch-API läuft zum halben Standard-Ein- und Ausgabepreis, und Prompt-Caching macht wiederholtes Lesen von Kontext mit 0,50 $ pro Million Token günstig[3].

So bekommst du Zugriff auf Claude Opus 4.8

Du kannst Claude Opus 4.8 direkt über Anthropic aufrufen oder über reAPIs OpenAI-kompatibles Gateway zu Anthropics Standardraten erreichen. Aktuelle Raten und ein Playground stehen auf reapi.ai/models/claude-opus-4-8. Der Vorteil des Gateways ist ein Key und ein Client über alle Anbieter hinweg: dieselbe Integration, die GPT-5 und Gemini sowie reAPIs Bild- und Videomodelle aufruft, ruft auch Claude Opus 4.8 auf.

Richte das OpenAI-SDK auf reAPI und setze das Modell:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_REAPI_KEY",
    base_url="https://api.reapi.ai/v1",
)

resp = client.chat.completions.create(
    model="claude-opus-4-8",
    messages=[
        {"role": "user", "content": "Refactor this function and explain the change."},
    ],
    extra_body={"group": "default"},
)
print(resp.choices[0].message.content)

Die native Anthropic-Oberfläche /v1/messages steht ebenfalls bereit, SDKs für beide Formate laufen also ohne Umbau. Eingabe kostet 5 $ pro Million Token und Ausgabe 25 $, dieselben Raten wie direkt bei Anthropic.

Für wen Claude Opus 4.8 gedacht ist

Opus 4.8 ist für Arbeit gebaut, bei der ein Fehler teuer ist und der Kontext groß:

  • Agentisches Coding. Langlaufende Aufgaben, bei denen das Modell plant, editiert und die eigene Arbeit prüft, und wo die Ehrlichkeitsgewinne stille Bugs reduzieren.
  • Analyse mit großem Kontext. Eine ganze Codebasis oder einen Dokumentensatz in einer Anfrage lesen, bis zu einer Million Token.
  • Tool-nutzende Agents. Workflows, die Tools aufrufen, Screenshots lesen und Zustand über viele Schritte tragen.
  • Reasoning mit hohem Einsatz. Recherche, Finanzanalyse und andere Arbeit, bei der ausgewiesene Unsicherheit besser ist als eine selbstbewusst falsche Antwort.

Für viele einfache Aufrufe ist ein kleineres, günstigeres Modell meist die bessere Wahl; Opus ist die Stufe, zu der du greifst, wenn Leistungsfähigkeit mehr zählt als Kosten pro Token.

Warum Claude Opus 4.8 2026 zählt

Das Interessante an Opus 4.8 ist kein einzelner Benchmark. Es ist, dass Anthropic ein Release für Verlässlichkeit ausgegeben hat und dafür gesorgt hat, dass das Modell eigene Fehler seltener durchgehen lässt, statt einer Rangliste hinterherzujagen. Beim agentischen Coding, wo ein Modell echten Code über viele Schritte bearbeitet, summiert sich diese Art Ehrlichkeit: weniger stille Bugs, die später auffallen. Zusammen mit einem Millionen-Token-Fenster und einem günstigeren Fast Mode zielt Opus 4.8 klar auf Teams, die Agents bauen, denen sie vertrauen müssen.

FAQ

Wann wurde Claude Opus 4.8 veröffentlicht?

Am 28. Mai 2026, als Upgrade von Claude Opus 4.7, zum gleichen Preis[1].

Wie groß ist das Kontextfenster von Claude Opus 4.8?

1 Mio. Token, über das gesamte Fenster zum Standard-Tokenpreis abgerechnet. Die maximale Ausgabe liegt bei 128K Token, über die Batch-API bei bis zu 300K[2].

Was kostet Claude Opus 4.8?

5 $ pro Million Eingabe-Token und 25 $ pro Million Ausgabe-Token, Cache-Lesen zu 0,50 $ und die Batch-API zum halben Preis[3]. Der Fast Mode kostet 10 $ Eingabe und 50 $ Ausgabe[1].

Ist Claude Opus 4.8 multimodal?

Es nimmt Text- und Bildeingabe entgegen und gibt Text aus, Vision wird unterstützt. Audio- oder Video-Eingabe listet Anthropic für das Modell nicht[2].

Wie unterscheidet sich Claude Opus 4.8 von Opus 4.7?

Gleicher Preis, höhere Ehrlichkeit (rund viermal seltener lässt es eigene Codefehler durchgehen), ein günstigerer und schnellerer Fast Mode und kleine Zugewinne quer durch Anthropics Benchmark-Suite[1].

Wie rufe ich Claude Opus 4.8 mit dem OpenAI-SDK auf?

Richte den OpenAI-Client auf https://api.reapi.ai/v1, setze model auf claude-opus-4-8 und sende eine normale Chat-Anfrage. reAPI stellt Claude über einen OpenAI-kompatiblen Endpunkt zu Anthropics Standardraten bereit.

Die Kurzfassung

Claude Opus 4.8 ist ein schrittweises, aber echtes Upgrade: gleicher Preis wie Opus 4.7, ein Kontextfenster von einer Million Token und ein bewusster Fokus auf Ehrlichkeit, der beim agentischen Coding am meisten zählt. Wenn du Agents baust, die Code bearbeiten oder über großen Kontext nachdenken, ist Claude Opus 4.8 derzeit die Spitze von Anthropics Linie, und du erreichst es über eine OpenAI-kompatible API neben jedem anderen Modell, das du aufrufst.

Further reading

References

  1. Anthropic. Introducing Claude Opus 4.8. Retrieved May 2026 from anthropic.com/news/claude-opus-4-8
  2. Anthropic. Models overview — context, output, modality, and capabilities. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/models/overview
  3. Anthropic. Pricing — token, cache, and batch rates. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/pricing