
¿Qué es Claude Opus 4.8? El nuevo modelo de Anthropic
Claude Opus 4.8 es el modelo más capaz de Anthropic para razonamiento y coding agéntico. Esto es lo nuevo, sus benchmarks, precios y cómo acceder a él.
Anthropic lanzó Claude Opus 4.8 el 28 de mayo de 2026, una mejora sobre Opus 4.7 que la propia empresa describe como modesta pero tangible[1]. Es el modelo más capaz de Anthropic para razonamiento complejo y coding agéntico de largo recorrido, y salió al mismo precio que el modelo al que sustituye. El titular no es un salto en benchmarks sino la fiabilidad: Claude Opus 4.8 tiene alrededor de cuatro veces menos probabilidad que Opus 4.7 de dejar pasar sin señalar un fallo en el código que él mismo escribió[1].
Esta guía explica qué es Claude Opus 4.8, qué cambió respecto a 4.7, sus benchmarks publicados, cuánto cuesta y cómo llamarlo desde una API compatible con OpenAI. Todas las cifras vienen del anuncio, la descripción del modelo y las páginas de precios de Anthropic, consultadas el 30 de mayo de 2026.
¿Qué es Claude Opus 4.8?
Claude Opus 4.8 es el modelo más reciente de la línea Opus de Anthropic, el nivel dirigido al razonamiento y al coding agéntico más exigentes. El identificador de la API es claude-opus-4-8, sin sufijo de fecha[2].
Las especificaciones básicas:
- Ventana de contexto: 1 M de tokens, facturada a la tarifa estándar por token en toda la ventana[2].
- Salida máxima: 128K tokens en la API síncrona, hasta 300K en la API Batch con una cabecera beta[2].
- Modalidades de entrada: texto e imagen. La salida es texto. La visión está soportada; Anthropic no lista entrada de audio ni de vídeo[2].
- Corte de conocimiento: enero de 2026[2].
Qué hay de nuevo frente a Opus 4.7
Anthropic presenta Opus 4.8 como una evolución de 4.7 más que como un reemplazo total, y lo lanza al mismo precio de entrada y salida[1]. Destacan tres cambios.
- Honestidad. Opus 4.8 tiene unas cuatro veces menos probabilidad que su predecesor de dejar pasar un fallo en su propio código sin marcarlo, y está más dispuesto a señalar incertidumbre en lugar de afirmar cosas sin respaldo[1].
- Un modo rápido más barato y más veloz. El modo rápido cuesta ahora 10 $ por millón de tokens de entrada y 50 $ por millón de salida, que según Anthropic es tres veces más barato y 2,5 veces más rápido que el nivel rápido de la generación anterior[1].
- Control de esfuerzo. El modelo usa
highpor defecto y puede subirse aextraomax, gastando más tokens para obtener mejores resultados en problemas difíciles[2].
Capacidades clave de Claude Opus 4.8
Una ventana de contexto de 1 M de tokens
Opus 4.8 lee hasta un millón de tokens en una sola petición, suficiente para una base de código grande o un conjunto largo de documentos, y una petición de 900K tokens se factura a la misma tarifa por token que una de 9K[2]. En Microsoft Foundry la ventana está limitada a 200K[2].
Coding agéntico y razonamiento
El modelo lidera la comparación publicada por Anthropic en coding agéntico y razonamiento multidisciplinar. Obtiene un 69,2 % en SWE-Bench Pro y un 57,9 % en Humanity's Last Exam con herramientas, ambos por delante de Opus 4.7[1]. Las cifras completas están en la tabla de benchmarks más abajo.
Control de esfuerzo y pensamiento adaptativo
En lugar de un único interruptor de pensamiento extendido, Opus 4.8 usa pensamiento adaptativo más un ajuste de esfuerzo. Dejarlo en el high por defecto sirve para la mayoría del trabajo; subirlo a extra o max cambia más tokens por razonamiento más profundo en las tareas más duras[2].
Visión, uso de herramientas y caché de prompts
Opus 4.8 acepta imagen junto al texto, soporta uso de herramientas y function calling, y funciona con caché de prompts para abaratar el contexto repetido[2]. Son los ladrillos para agentes que leen capturas, llaman herramientas y arrastran contexto largo a lo largo de una sesión.
Benchmarks de Claude Opus 4.8
Estos son los resultados publicados por Anthropic, comparando Opus 4.8 con Opus 4.7, GPT-5.5 y Gemini 3.1 Pro[1]. Como con cualquier benchmark ejecutado por el fabricante, trátalos como señal direccional y no como una auditoría neutral.
| Benchmark | Opus 4.8 | Opus 4.7 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Coding agéntico (SWE-Bench Pro) | 69,2 % | 64,3 % | 58,6 % | 54,2 % |
| Coding en terminal (Terminal-Bench 2.1) | 74,6 % | 66,1 % | 78,2 % | 70,3 % |
| Razonamiento (Humanity's Last Exam, sin herramientas) | 49,8 % | 46,9 % | 41,4 % | 44,4 % |
| Razonamiento (Humanity's Last Exam, con herramientas) | 57,9 % | 54,7 % | 52,2 % | 51,4 % |
| Uso del ordenador (OSWorld-Verified) | 83,4 % | 82,8 % | 78,7 % | 76,2 % |
| Trabajo de conocimiento (GDPval-AA) | 1890 | 1753 | 1769 | 1314 |
| Análisis financiero (Finance Agent v2) | 53,9 % | 51,5 % | 51,8 % | 43,0 % |
Opus 4.8 encabeza todas las filas salvo Terminal-Bench 2.1, donde GPT-5.5 manda con un 78,2 %[1].
Precios de Claude Opus 4.8
Los precios son por millón de tokens (MTok) y no cambian respecto a Opus 4.7[1][3]:
| Concepto | Precio / MTok |
|---|---|
| Entrada | 5 $ |
| Salida | 25 $ |
| Lectura de caché | 0,50 $ |
| Escritura de caché (5 minutos) | 6,25 $ |
| Escritura de caché (1 hora) | 10 $ |
| Entrada Batch | 2,50 $ |
| Salida Batch | 12,50 $ |
| Entrada modo rápido | 10 $ |
| Salida modo rápido | 50 $ |
La API Batch va a mitad de precio de entrada y salida, y la caché de prompts abarata releer contexto repetido a 0,50 $ por millón de tokens[3].
Cómo acceder a Claude Opus 4.8
Puedes llamar a Claude Opus 4.8 directamente en Anthropic o alcanzarlo por el gateway compatible con OpenAI de reAPI a las tarifas estándar de Anthropic. Consulta reapi.ai/models/claude-opus-4-8 para tarifas en vivo y un playground. La ventaja del gateway es una clave y un cliente para todos los proveedores: la misma integración que llama a GPT-5 y Gemini, más los modelos de imagen y vídeo de reAPI, también llama a Claude Opus 4.8.
Apunta el SDK de OpenAI a reAPI y fija el modelo:
from openai import OpenAI
client = OpenAI(
api_key="YOUR_REAPI_KEY",
base_url="https://api.reapi.ai/v1",
)
resp = client.chat.completions.create(
model="claude-opus-4-8",
messages=[
{"role": "user", "content": "Refactor this function and explain the change."},
],
extra_body={"group": "default"},
)
print(resp.choices[0].message.content)La superficie nativa de Anthropic /v1/messages también está disponible, así que los SDK escritos para cualquiera de los dos formatos funcionan sin reescribir nada. La entrada cuesta 5 $ por millón de tokens y la salida 25 $, las mismas tarifas que cobra Anthropic directamente.
Quién debería usar Claude Opus 4.8
Opus 4.8 está pensado para trabajo donde un error sale caro y el contexto es grande:
- Coding agéntico. Tareas de largo recorrido donde el modelo planifica, edita y verifica su propio trabajo, y donde las mejoras de honestidad reducen bugs silenciosos.
- Análisis con contexto grande. Leer una base de código o un conjunto documental completo en una petición, hasta un millón de tokens.
- Agentes que usan herramientas. Flujos que llaman herramientas, leen capturas y arrastran estado durante muchos pasos.
- Razonamiento de alto riesgo. Investigación, análisis financiero y otro trabajo donde señalar incertidumbre vale más que una respuesta segura y equivocada.
Para llamadas de alto volumen y baja complejidad, un modelo más pequeño y barato suele encajar mejor; Opus es el nivel al que recurres cuando la capacidad importa más que el coste por token.
Por qué Claude Opus 4.8 importa en 2026
Lo interesante de Opus 4.8 no es un benchmark concreto. Es que Anthropic dedicó una versión a la fiabilidad, recortando cuánto deja pasar el modelo sus propios errores, en lugar de perseguir una clasificación. En coding agéntico, donde un modelo edita código real a lo largo de muchos pasos, esa honestidad se acumula: menos bugs silenciosos que cazar después. Junto a una ventana de un millón de tokens y un modo rápido más barato, Opus 4.8 apunta de lleno a los equipos que construyen agentes en los que tienen que confiar.
FAQ
¿Cuándo se lanzó Claude Opus 4.8?
El 28 de mayo de 2026, como mejora de Claude Opus 4.7 y al mismo precio[1].
¿Cuál es la ventana de contexto de Claude Opus 4.8?
1 M de tokens, facturada a la tarifa estándar por token en toda la ventana. La salida máxima es de 128K tokens, o hasta 300K en la API Batch[2].
¿Cuánto cuesta Claude Opus 4.8?
5 $ por millón de tokens de entrada y 25 $ por millón de salida, con lecturas de caché a 0,50 $ y la API Batch a mitad de precio[3]. El modo rápido son 10 $ de entrada y 50 $ de salida[1].
¿Es multimodal Claude Opus 4.8?
Acepta entrada de texto e imagen y devuelve texto, con visión soportada. Anthropic no lista entrada de audio ni de vídeo para el modelo[2].
¿En qué se diferencia Claude Opus 4.8 de Opus 4.7?
Mismo precio, con más honestidad (unas cuatro veces menos probabilidad de dejar pasar fallos de su propio código), un modo rápido más barato y veloz, y pequeñas mejoras en toda la batería de benchmarks de Anthropic[1].
¿Cómo llamo a Claude Opus 4.8 con el SDK de OpenAI?
Apunta el cliente de OpenAI a https://api.reapi.ai/v1, pon model en claude-opus-4-8 y envía una petición de chat normal. reAPI expone Claude por un endpoint compatible con OpenAI a las tarifas estándar de Anthropic.
La versión corta
Claude Opus 4.8 es una mejora incremental pero real: el mismo precio que Opus 4.7, un contexto de un millón de tokens y un foco deliberado en la honestidad que más pesa en coding agéntico. Si construyes agentes que editan código o razonan sobre contexto grande, Claude Opus 4.8 es ahora mismo la cima de la línea de Anthropic, y puedes alcanzarlo por una API compatible con OpenAI junto a todos los demás modelos que llames.
Further reading
- reapi.ai/docs/claude-opus-4-8 — referencia del endpoint y ejemplos de SDK.
- What is reAPI? — la API unificada tras una clave para chat, imagen y vídeo.
- reapi.ai/models — explora el catálogo completo de modelos.
References
- Anthropic. Introducing Claude Opus 4.8. Retrieved May 2026 from anthropic.com/news/claude-opus-4-8
- Anthropic. Models overview — context, output, modality, and capabilities. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/models/overview
- Anthropic. Pricing — token, cache, and batch rates. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/pricing
Autor

Categorías
Más publicaciones

Gemini Omni vs Veo 3.1: ¿conviene migrar en mayo de 2026?
Gemini Omni vs Veo 3.1 en mayo de 2026: Google solo sustituye Veo en la app Gemini, no en la API. Mapeo de los cinco canales, diff de código y quién gana.


Seedance 2.0 más barato en 2026: precios reales comparados
¿Dónde sale más barato Seedance 2.0? Precios por segundo verificados en la API oficial, Replicate, fal.ai, suscripciones y reAPI, desde 0,03 $ por segundo.


Coherencia de personajes en Seedance 2.0: guía oficial
El método oficial para mantener al mismo personaje: sintaxis de referencias, 12 entradas, voz, sincronización labial y prompts con varios planos.
