
Qu'est-ce que Claude Opus 4.8 ? Le modèle d'Anthropic
Claude Opus 4.8 est le modèle le plus performant d'Anthropic pour le raisonnement et le coding agentique. Nouveautés, benchmarks, prix et accès.
Anthropic a publié Claude Opus 4.8 le 28 mai 2026, une mise à niveau d'Opus 4.7 que l'entreprise décrit elle-même comme modeste mais tangible[1]. C'est le modèle le plus performant d'Anthropic pour le raisonnement complexe et le coding agentique de long cours, et il est sorti au prix du modèle qu'il remplace. Le point saillant n'est pas un bond dans les benchmarks mais la fiabilité : Claude Opus 4.8 a environ quatre fois moins de chances qu'Opus 4.7 de laisser passer sans le signaler un défaut dans le code qu'il a lui-même écrit[1].
Ce guide explique ce qu'est Claude Opus 4.8, ce qui a changé depuis 4.7, ses benchmarks publiés, son coût et la façon de l'appeler via une API compatible OpenAI. Tous les chiffres viennent de l'annonce, de la description du modèle et des pages de tarifs d'Anthropic, consultées le 30 mai 2026.
Qu'est-ce que Claude Opus 4.8 ?
Claude Opus 4.8 est le dernier modèle de la ligne Opus d'Anthropic, le palier destiné aux travaux de raisonnement et de coding agentique les plus exigeants. L'identifiant d'API est claude-opus-4-8, sans suffixe de date[2].
Les caractéristiques principales :
- Fenêtre de contexte : 1 M de tokens, facturée au tarif standard par token sur toute la fenêtre[2].
- Sortie maximale : 128K tokens sur l'API synchrone, jusqu'à 300K sur l'API Batch avec un en-tête bêta[2].
- Modalités d'entrée : texte et image. La sortie est du texte. La vision est prise en charge ; Anthropic ne liste ni entrée audio ni entrée vidéo[2].
- Date de coupure des connaissances : janvier 2026[2].
Ce qui change par rapport à Opus 4.7
Anthropic présente Opus 4.8 comme une évolution de 4.7 plutôt qu'un remplacement complet, et le livre au même prix en entrée et en sortie[1]. Trois changements ressortent.
- Honnêteté. Opus 4.8 a environ quatre fois moins de chances que son prédécesseur de laisser passer un défaut dans son propre code sans le signaler, et il marque plus volontiers l'incertitude au lieu d'affirmer des choses non étayées[1].
- Un mode rapide moins cher et plus véloce. Le mode rapide coûte désormais 10 $ par million de tokens en entrée et 50 $ par million en sortie, ce qu'Anthropic annonce comme trois fois moins cher et 2,5 fois plus rapide que le palier rapide de la génération précédente[1].
- Contrôle de l'effort. Le modèle est par défaut sur
highet peut monter àextraoumax, dépensant plus de tokens pour de meilleurs résultats sur les problèmes difficiles[2].
Capacités clés de Claude Opus 4.8
Une fenêtre de contexte de 1 M de tokens
Opus 4.8 lit jusqu'à un million de tokens en une requête, de quoi couvrir une grosse base de code ou un long corpus documentaire, et une requête de 900K tokens est facturée au même tarif par token qu'une requête de 9K[2]. Sur Microsoft Foundry, la fenêtre est plafonnée à 200K[2].
Coding agentique et raisonnement
Le modèle domine la comparaison publiée par Anthropic sur le coding agentique et le raisonnement multidisciplinaire. Il obtient 69,2 % sur SWE-Bench Pro et 57,9 % sur Humanity's Last Exam avec outils, les deux devant Opus 4.7[1]. Les chiffres complets figurent dans le tableau plus bas.
Contrôle de l'effort et réflexion adaptative
Plutôt qu'un simple interrupteur de réflexion étendue, Opus 4.8 combine réflexion adaptative et réglage d'effort. Laisser l'effort sur high convient à la plupart des travaux ; passer à extra ou max échange plus de tokens contre un raisonnement plus profond sur les tâches les plus dures[2].
Vision, usage d'outils et mise en cache des prompts
Opus 4.8 accepte l'image en plus du texte, prend en charge l'usage d'outils et le function calling, et fonctionne avec la mise en cache des prompts pour réduire le coût du contexte répété[2]. Ce sont les briques d'agents qui lisent des captures d'écran, appellent des outils et portent un long contexte au fil d'une session.
Benchmarks de Claude Opus 4.8
Voici les résultats publiés par Anthropic, comparant Opus 4.8 à Opus 4.7, GPT-5.5 et Gemini 3.1 Pro[1]. Comme pour tout benchmark exécuté par le fournisseur, à lire comme un signal directionnel et non comme un audit neutre.
| Benchmark | Opus 4.8 | Opus 4.7 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Coding agentique (SWE-Bench Pro) | 69,2 % | 64,3 % | 58,6 % | 54,2 % |
| Coding terminal (Terminal-Bench 2.1) | 74,6 % | 66,1 % | 78,2 % | 70,3 % |
| Raisonnement (Humanity's Last Exam, sans outils) | 49,8 % | 46,9 % | 41,4 % | 44,4 % |
| Raisonnement (Humanity's Last Exam, avec outils) | 57,9 % | 54,7 % | 52,2 % | 51,4 % |
| Usage de l'ordinateur (OSWorld-Verified) | 83,4 % | 82,8 % | 78,7 % | 76,2 % |
| Travail de connaissance (GDPval-AA) | 1890 | 1753 | 1769 | 1314 |
| Analyse financière (Finance Agent v2) | 53,9 % | 51,5 % | 51,8 % | 43,0 % |
Opus 4.8 arrive en tête sur toutes les lignes sauf Terminal-Bench 2.1, où GPT-5.5 mène à 78,2 %[1].
Tarifs de Claude Opus 4.8
Les tarifs s'entendent par million de tokens (MTok) et n'ont pas changé depuis Opus 4.7[1][3] :
| Poste | Prix / MTok |
|---|---|
| Entrée | 5 $ |
| Sortie | 25 $ |
| Lecture de cache | 0,50 $ |
| Écriture de cache (5 minutes) | 6,25 $ |
| Écriture de cache (1 heure) | 10 $ |
| Entrée Batch | 2,50 $ |
| Sortie Batch | 12,50 $ |
| Entrée mode rapide | 10 $ |
| Sortie mode rapide | 50 $ |
L'API Batch tourne à moitié prix en entrée comme en sortie, et la mise en cache des prompts rend la relecture de contexte répété peu coûteuse, à 0,50 $ par million de tokens[3].
Comment accéder à Claude Opus 4.8
Vous pouvez appeler Claude Opus 4.8 directement chez Anthropic, ou l'atteindre via la passerelle compatible OpenAI de reAPI aux tarifs standard d'Anthropic. Consultez reapi.ai/models/claude-opus-4-8 pour les tarifs en direct et un playground. L'avantage de la passerelle, c'est une clé et un client pour tous les fournisseurs : la même intégration qui appelle GPT-5 et Gemini, plus les modèles image et vidéo de reAPI, appelle aussi Claude Opus 4.8.
Pointez le SDK OpenAI vers reAPI et définissez le modèle :
from openai import OpenAI
client = OpenAI(
api_key="YOUR_REAPI_KEY",
base_url="https://api.reapi.ai/v1",
)
resp = client.chat.completions.create(
model="claude-opus-4-8",
messages=[
{"role": "user", "content": "Refactor this function and explain the change."},
],
extra_body={"group": "default"},
)
print(resp.choices[0].message.content)La surface native d'Anthropic /v1/messages reste disponible : les SDK écrits pour l'un ou l'autre format fonctionnent sans réécriture. L'entrée coûte 5 $ par million de tokens et la sortie 25 $, les tarifs qu'Anthropic facture directement.
À qui s'adresse Claude Opus 4.8
Opus 4.8 est conçu pour les travaux où une erreur coûte cher et où le contexte est vaste :
- Coding agentique. Tâches de long cours où le modèle planifie, édite et vérifie son propre travail, et où les gains d'honnêteté réduisent les bugs silencieux.
- Analyse à grand contexte. Lire une base de code ou un corpus documentaire entier en une requête, jusqu'à un million de tokens.
- Agents utilisant des outils. Flux qui appellent des outils, lisent des captures et portent un état sur de nombreuses étapes.
- Raisonnement à fort enjeu. Recherche, analyse financière et autres travaux où une incertitude signalée vaut mieux qu'une réponse fausse énoncée avec assurance.
Pour des appels nombreux et peu complexes, un modèle plus petit et moins cher convient généralement mieux ; Opus est le palier vers lequel on se tourne quand la capacité compte plus que le coût par token.
Pourquoi Claude Opus 4.8 compte en 2026
L'intéressant avec Opus 4.8 n'est pas un benchmark en particulier. C'est qu'Anthropic a consacré une version à la fiabilité, en réduisant la fréquence à laquelle le modèle laisse passer ses propres erreurs, au lieu de courir après un classement. En coding agentique, où un modèle édite du vrai code sur de nombreuses étapes, ce type d'honnêteté se cumule : moins de bugs silencieux à rattraper en aval. Associé à une fenêtre d'un million de tokens et à un mode rapide moins cher, Opus 4.8 vise clairement les équipes qui construisent des agents auxquels elles doivent pouvoir se fier.
FAQ
Quand Claude Opus 4.8 est-il sorti ?
Le 28 mai 2026, en mise à niveau de Claude Opus 4.7, au même prix[1].
Quelle est la fenêtre de contexte de Claude Opus 4.8 ?
1 M de tokens, facturée au tarif standard par token sur toute la fenêtre. La sortie maximale est de 128K tokens, ou jusqu'à 300K sur l'API Batch[2].
Combien coûte Claude Opus 4.8 ?
5 $ par million de tokens en entrée et 25 $ par million en sortie, avec les lectures de cache à 0,50 $ et l'API Batch à moitié prix[3]. Le mode rapide est à 10 $ en entrée et 50 $ en sortie[1].
Claude Opus 4.8 est-il multimodal ?
Il accepte du texte et de l'image en entrée et renvoie du texte, la vision étant prise en charge. Anthropic ne liste ni entrée audio ni entrée vidéo pour ce modèle[2].
En quoi Claude Opus 4.8 diffère-t-il d'Opus 4.7 ?
Même prix, avec une honnêteté accrue (environ quatre fois moins de chances de laisser passer ses propres défauts de code), un mode rapide moins cher et plus rapide, et de petits gains sur toute la suite de benchmarks d'Anthropic[1].
Comment appeler Claude Opus 4.8 avec le SDK OpenAI ?
Pointez le client OpenAI vers https://api.reapi.ai/v1, mettez model sur claude-opus-4-8 et envoyez une requête de chat classique. reAPI expose Claude via un endpoint compatible OpenAI aux tarifs standard d'Anthropic.
En résumé
Claude Opus 4.8 est une mise à niveau incrémentale mais réelle : le même prix qu'Opus 4.7, un contexte d'un million de tokens et un travail délibéré sur l'honnêteté, ce qui compte le plus en coding agentique. Si vous construisez des agents qui éditent du code ou raisonnent sur un vaste contexte, Claude Opus 4.8 est aujourd'hui le sommet de la ligne d'Anthropic, et vous pouvez l'atteindre via une API compatible OpenAI aux côtés de tous les autres modèles que vous appelez.
Further reading
- reapi.ai/docs/claude-opus-4-8 — référence de l'endpoint et exemples de SDK.
- What is reAPI? — l'API unifiée derrière une clé pour le chat, l'image et la vidéo.
- reapi.ai/models — parcourir le catalogue complet de modèles.
References
- Anthropic. Introducing Claude Opus 4.8. Retrieved May 2026 from anthropic.com/news/claude-opus-4-8
- Anthropic. Models overview — context, output, modality, and capabilities. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/models/overview
- Anthropic. Pricing — token, cache, and batch rates. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/pricing
Auteur

Catégories
Plus d'articles

Cohérence des personnages dans Seedance 2.0 : le guide
La méthode officielle pour garder le même personnage : syntaxe des références, budget de 12 emplacements, voix, synchronisation labiale et prompts multi-plans.


Alternatives à Mammouth.ai en 2026 : 5 outils comparés
Alternatives à Mammouth.ai en 2026 : comment Poe, Perplexity, OpenRouter, HuggingChat et reAPI diffèrent sur les modèles, les fonctions et l'usage réel.


Alternatives à fal.ai en 2026 : 5 options comparées
Vous cherchez des alternatives à fal.ai en 2026 ? Comparez Replicate, Together AI, RunPod, Hugging Face et reAPI sur les modèles, les prix, la vitesse et l'API.
