
Что такое Claude Opus 4.8? Бенчмарки, цены и доступ к API
Claude Opus 4.8 — новая модель Anthropic для рассуждений и агентного кодирования. Что изменилось, бенчмарки, цены и как вызвать её через API.
Anthropic выпустила Claude Opus 4.8 28 мая 2026 года — обновление Opus 4.7, которое сама компания описывает как умеренное, но ощутимое улучшение[1]. Это самая производительная модель Anthropic для сложных рассуждений и долгих сессий агентного кодирования, и вышла она по цене предшественника. Главное изменение здесь не рывок в бенчмарках, а надёжность: Claude Opus 4.8 примерно вчетверо реже, чем Opus 4.7, пропускает без комментария ошибку в написанном ею же коде[1].
В этом руководстве разбираем, что такое Claude Opus 4.8, что изменилось по сравнению с 4.7, какие бенчмарки опубликованы, сколько модель стоит и как вызвать её через OpenAI-совместимый API. Все цифры ниже взяты из анонса Anthropic, обзора моделей и страницы с ценами; данные получены 30 мая 2026 года.
Что такое Claude Opus 4.8?
Claude Opus 4.8 — новейшая модель в линейке Opus у Anthropic, то есть уровень для самых тяжёлых задач по рассуждениям и агентному кодированию. Идентификатор в API — claude-opus-4-8, без суффикса с датой[2].
Ключевые характеристики:
- Контекстное окно: 1 млн токенов, причём всё окно тарифицируется по стандартной ставке за токен[2].
- Максимальный вывод: 128K токенов через синхронный API и до 300K через Batch API с бета-заголовком[2].
- Входные модальности: текст и изображения. На выходе — текст. Зрение поддерживается; аудио и видео на входе Anthropic не заявляет[2].
- Актуальность знаний: январь 2026 года[2].
Что нового по сравнению с Opus 4.7
Anthropic подаёт Opus 4.8 как развитие 4.7, а не как полную замену, и выпускает модель по той же цене на вход и выход[1]. Выделяются три изменения.
- Честность. Opus 4.8 примерно вчетверо реже предшественника пропускает ошибку в собственном коде, не пометив её, и охотнее обозначает неуверенность вместо ничем не подкреплённых утверждений[1].
- Более дешёвый и быстрый быстрый режим (fast mode). Теперь он стоит $10 за миллион входных токенов и $50 за миллион выходных: по данным Anthropic, это втрое дешевле и в 2.5 раза быстрее, чем аналогичный режим предыдущего поколения[1].
- Управление усилиями (effort). По умолчанию модель работает на уровне
high, но его можно поднять доextraилиmaxи потратить больше токенов ради лучшего результата на трудных задачах[2].
Основные возможности Claude Opus 4.8
Контекстное окно на 1 млн токенов
Opus 4.8 читает до миллиона токенов за один запрос — этого хватает на большую кодовую базу или длинный набор документов, а запрос на 900K токенов тарифицируется по той же ставке за токен, что и запрос на 9K[2]. В Microsoft Foundry окно ограничено 200K[2].
Агентное кодирование и рассуждения
В опубликованном Anthropic сравнении модель лидирует по агентному кодированию и междисциплинарным рассуждениям. Она набирает 69.2% на SWE-Bench Pro и 57.9% на Humanity's Last Exam с инструментами — в обоих случаях выше Opus 4.7[1]. Полные цифры собраны в таблице бенчмарков ниже.
Управление усилиями и адаптивное мышление
Вместо одного переключателя расширенного мышления Opus 4.8 использует адаптивное мышление плюс настройку усилий. Значение по умолчанию high подходит для большинства задач; переключение на extra или max обменивает дополнительные токены на более глубокие рассуждения в самых трудных случаях[2].
Зрение, использование инструментов и кеширование промптов
Opus 4.8 принимает изображения наряду с текстом, поддерживает использование инструментов и вызов функций, а также работает с кешированием промптов, чтобы повторяющийся контекст обходился дешевле[2]. Это строительные блоки для агентов, которые читают скриншоты, вызывают инструменты и тянут длинный контекст через всю сессию.
Бенчмарки Claude Opus 4.8
Ниже — собственные опубликованные результаты Anthropic: сравнение Opus 4.8 с Opus 4.7, GPT-5.5 и Gemini 3.1 Pro[1]. Как и с любыми замерами от самого вендора, читайте их как ориентир, а не как независимую проверку.
| Бенчмарк | Opus 4.8 | Opus 4.7 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Агентное кодирование (SWE-Bench Pro) | 69.2% | 64.3% | 58.6% | 54.2% |
| Кодирование в терминале (Terminal-Bench 2.1) | 74.6% | 66.1% | 78.2% | 70.3% |
| Рассуждения (Humanity's Last Exam, без инструментов) | 49.8% | 46.9% | 41.4% | 44.4% |
| Рассуждения (Humanity's Last Exam, с инструментами) | 57.9% | 54.7% | 52.2% | 51.4% |
| Работа с компьютером (OSWorld-Verified) | 83.4% | 82.8% | 78.7% | 76.2% |
| Интеллектуальный труд (GDPval-AA) | 1890 | 1753 | 1769 | 1314 |
| Финансовый анализ (Finance Agent v2) | 53.9% | 51.5% | 51.8% | 43.0% |
Opus 4.8 идёт первым в каждой строке, кроме Terminal-Bench 2.1, где впереди GPT-5.5 с 78.2%[1].
Цены на Claude Opus 4.8
Цены указаны за миллион токенов (MTok) и не изменились относительно Opus 4.7[1][3]:
| Позиция | Цена / MTok |
|---|---|
| Вход | $5 |
| Выход | $25 |
| Чтение из кеша | $0.50 |
| Запись в кеш (5 минут) | $6.25 |
| Запись в кеш (1 час) | $10 |
| Batch-вход | $2.50 |
| Batch-выход | $12.50 |
| Вход в быстром режиме | $10 |
| Выход в быстром режиме | $50 |
Batch API работает по половине стандартной цены на вход и выход, а кеширование промптов делает повторное чтение уже отправленного контекста дешёвым — $0.50 за миллион токенов[3].
Как получить доступ к Claude Opus 4.8
Вызывать Claude Opus 4.8 можно напрямую через Anthropic либо через OpenAI-совместимый шлюз reAPI по стандартным тарифам Anthropic. Актуальные тарифы и песочница есть на странице reapi.ai/models/claude-opus-4-8. Выгода шлюза — один ключ и один клиент на всех провайдеров: та же интеграция, которая вызывает GPT-5 и Gemini, а заодно модели reAPI для изображений и видео, вызывает и Claude Opus 4.8.
Направьте OpenAI SDK на reAPI и укажите модель:
from openai import OpenAI
client = OpenAI(
api_key="YOUR_REAPI_KEY",
base_url="https://api.reapi.ai/v1",
)
resp = client.chat.completions.create(
model="claude-opus-4-8",
messages=[
{"role": "user", "content": "Refactor this function and explain the change."},
],
extra_body={"group": "default"},
)
print(resp.choices[0].message.content)Нативный интерфейс Anthropic /v1/messages тоже доступен, так что SDK, написанные под любой из двух форматов, работают без переделки. Вход стоит $5 за миллион токенов, выход — $25: те же ставки, что Anthropic берёт напрямую.
Кому подойдёт Claude Opus 4.8
Opus 4.8 сделан для задач, где ошибка стоит дорого, а контекст велик:
- Агентное кодирование. Долгие задачи, в которых модель планирует, правит код и проверяет собственную работу, а выигрыш в честности сокращает число незамеченных багов.
- Анализ на большом контексте. Чтение целой кодовой базы или набора документов за один запрос — вплоть до миллиона токенов.
- Агенты с инструментами. Сценарии, где нужно вызывать инструменты, читать скриншоты и удерживать состояние на протяжении многих шагов.
- Рассуждения с высокой ценой ошибки. Исследования, финансовый анализ и другая работа, где честно обозначенная неуверенность лучше уверенного неверного ответа.
Для массовых несложных вызовов обычно выгоднее модель поменьше и подешевле; Opus — тот уровень, к которому обращаются, когда возможности важнее стоимости токена.
Почему Claude Opus 4.8 важен в 2026 году
Интереснее всего в Opus 4.8 не отдельный бенчмарк. Интересно то, что Anthropic потратила целый релиз на надёжность и снизила частоту, с которой модель пропускает собственные ошибки, вместо гонки за строчкой в рейтинге. В агентном кодировании, где модель правит настоящий код на протяжении многих шагов, такая честность накапливается: меньше тихих багов всплывает потом. Вместе с окном на миллион токенов и подешевевшим быстрым режимом Opus 4.8 нацелен прямо на команды, которые строят агентов и вынуждены им доверять.
FAQ
Когда вышел Claude Opus 4.8?
28 мая 2026 года, как обновление Claude Opus 4.7 и по той же цене[1].
Какое контекстное окно у Claude Opus 4.8?
1 млн токенов, и всё окно тарифицируется по стандартной ставке за токен. Максимальный вывод — 128K токенов, а через Batch API до 300K[2].
Сколько стоит Claude Opus 4.8?
$5 за миллион входных токенов и $25 за миллион выходных, чтение из кеша — $0.50, Batch API — за полцены[3]. В быстром режиме вход стоит $10, выход — $50[1].
Мультимодален ли Claude Opus 4.8?
Он принимает на вход текст и изображения, а отдаёт текст; зрение поддерживается. Аудио и видео на входе Anthropic для этой модели не заявляет[2].
Чем Claude Opus 4.8 отличается от Opus 4.7?
Цена та же, зато выше честность (примерно вчетверо реже пропускает ошибки в собственном коде), быстрый режим стал дешевле и быстрее, и по всему набору бенчмарков Anthropic есть небольшой прирост[1].
Как вызвать Claude Opus 4.8 через OpenAI SDK?
Направьте клиент OpenAI на https://api.reapi.ai/v1, задайте в model значение claude-opus-4-8 и отправьте обычный чат-запрос. reAPI отдаёт Claude через OpenAI-совместимый эндпоинт по стандартным тарифам Anthropic.
Коротко
Claude Opus 4.8 — обновление постепенное, но реальное: та же цена, что у Opus 4.7, контекст на миллион токенов и осознанная ставка на честность, которая сильнее всего окупается в агентном кодировании. Если вы строите агентов, которые правят код или рассуждают на большом контексте, Claude Opus 4.8 — текущая вершина линейки Anthropic, и добраться до неё можно через OpenAI-совместимый API вместе со всеми остальными моделями, которые вы вызываете.
Further reading
- reapi.ai/docs/claude-opus-4-8 — справочник по эндпоинтам и примеры для SDK.
- What is reAPI? — единый API с одним ключом для чата, изображений и видео.
- reapi.ai/models — весь каталог моделей.
References
- Anthropic. Introducing Claude Opus 4.8. Retrieved May 2026 from anthropic.com/news/claude-opus-4-8
- Anthropic. Models overview — context, output, modality, and capabilities. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/models/overview
- Anthropic. Pricing — token, cache, and batch rates. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/pricing
Автор

Категории
Ещё статьи

Альтернативы Together AI в 2026: сравнение 5 сервисов
Ищете аналоги Together AI в 2026 году? Сравниваем OpenRouter, Replicate, RunPod, Hugging Face и reAPI по каталогу моделей, ценам, скорости и дизайну API.


Что такое reAPI: модели, цены и использование в 2026 году
reAPI — совместимый с OpenAI API для более чем 200 моделей изображений, видео, аудио и чата. Узнайте о функциях, ценах и первом вызове.


Лучшие альтернативы WaveSpeed в 2026 году: сравнение 5 вариантов
Ищете альтернативу WaveSpeed? Сравните fal.ai, Replicate, Together AI, RunPod и reAPI по моделям, ценам, скорости и устройству API.
