Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 за секунду
Что такое Claude Opus 4.8? Бенчмарки, цены и доступ к API
2026/05/30

Что такое Claude Opus 4.8? Бенчмарки, цены и доступ к API

Claude Opus 4.8 — новая модель Anthropic для рассуждений и агентного кодирования. Что изменилось, бенчмарки, цены и как вызвать её через API.

Anthropic выпустила Claude Opus 4.8 28 мая 2026 года — обновление Opus 4.7, которое сама компания описывает как умеренное, но ощутимое улучшение[1]. Это самая производительная модель Anthropic для сложных рассуждений и долгих сессий агентного кодирования, и вышла она по цене предшественника. Главное изменение здесь не рывок в бенчмарках, а надёжность: Claude Opus 4.8 примерно вчетверо реже, чем Opus 4.7, пропускает без комментария ошибку в написанном ею же коде[1].

В этом руководстве разбираем, что такое Claude Opus 4.8, что изменилось по сравнению с 4.7, какие бенчмарки опубликованы, сколько модель стоит и как вызвать её через OpenAI-совместимый API. Все цифры ниже взяты из анонса Anthropic, обзора моделей и страницы с ценами; данные получены 30 мая 2026 года.

Что такое Claude Opus 4.8?

Claude Opus 4.8 — новейшая модель в линейке Opus у Anthropic, то есть уровень для самых тяжёлых задач по рассуждениям и агентному кодированию. Идентификатор в API — claude-opus-4-8, без суффикса с датой[2].

Ключевые характеристики:

  • Контекстное окно: 1 млн токенов, причём всё окно тарифицируется по стандартной ставке за токен[2].
  • Максимальный вывод: 128K токенов через синхронный API и до 300K через Batch API с бета-заголовком[2].
  • Входные модальности: текст и изображения. На выходе — текст. Зрение поддерживается; аудио и видео на входе Anthropic не заявляет[2].
  • Актуальность знаний: январь 2026 года[2].

Что нового по сравнению с Opus 4.7

Anthropic подаёт Opus 4.8 как развитие 4.7, а не как полную замену, и выпускает модель по той же цене на вход и выход[1]. Выделяются три изменения.

  • Честность. Opus 4.8 примерно вчетверо реже предшественника пропускает ошибку в собственном коде, не пометив её, и охотнее обозначает неуверенность вместо ничем не подкреплённых утверждений[1].
  • Более дешёвый и быстрый быстрый режим (fast mode). Теперь он стоит $10 за миллион входных токенов и $50 за миллион выходных: по данным Anthropic, это втрое дешевле и в 2.5 раза быстрее, чем аналогичный режим предыдущего поколения[1].
  • Управление усилиями (effort). По умолчанию модель работает на уровне high, но его можно поднять до extra или max и потратить больше токенов ради лучшего результата на трудных задачах[2].

Основные возможности Claude Opus 4.8

Контекстное окно на 1 млн токенов

Opus 4.8 читает до миллиона токенов за один запрос — этого хватает на большую кодовую базу или длинный набор документов, а запрос на 900K токенов тарифицируется по той же ставке за токен, что и запрос на 9K[2]. В Microsoft Foundry окно ограничено 200K[2].

Агентное кодирование и рассуждения

В опубликованном Anthropic сравнении модель лидирует по агентному кодированию и междисциплинарным рассуждениям. Она набирает 69.2% на SWE-Bench Pro и 57.9% на Humanity's Last Exam с инструментами — в обоих случаях выше Opus 4.7[1]. Полные цифры собраны в таблице бенчмарков ниже.

Управление усилиями и адаптивное мышление

Вместо одного переключателя расширенного мышления Opus 4.8 использует адаптивное мышление плюс настройку усилий. Значение по умолчанию high подходит для большинства задач; переключение на extra или max обменивает дополнительные токены на более глубокие рассуждения в самых трудных случаях[2].

Зрение, использование инструментов и кеширование промптов

Opus 4.8 принимает изображения наряду с текстом, поддерживает использование инструментов и вызов функций, а также работает с кешированием промптов, чтобы повторяющийся контекст обходился дешевле[2]. Это строительные блоки для агентов, которые читают скриншоты, вызывают инструменты и тянут длинный контекст через всю сессию.

Бенчмарки Claude Opus 4.8

Ниже — собственные опубликованные результаты Anthropic: сравнение Opus 4.8 с Opus 4.7, GPT-5.5 и Gemini 3.1 Pro[1]. Как и с любыми замерами от самого вендора, читайте их как ориентир, а не как независимую проверку.

БенчмаркOpus 4.8Opus 4.7GPT-5.5Gemini 3.1 Pro
Агентное кодирование (SWE-Bench Pro)69.2%64.3%58.6%54.2%
Кодирование в терминале (Terminal-Bench 2.1)74.6%66.1%78.2%70.3%
Рассуждения (Humanity's Last Exam, без инструментов)49.8%46.9%41.4%44.4%
Рассуждения (Humanity's Last Exam, с инструментами)57.9%54.7%52.2%51.4%
Работа с компьютером (OSWorld-Verified)83.4%82.8%78.7%76.2%
Интеллектуальный труд (GDPval-AA)1890175317691314
Финансовый анализ (Finance Agent v2)53.9%51.5%51.8%43.0%

Opus 4.8 идёт первым в каждой строке, кроме Terminal-Bench 2.1, где впереди GPT-5.5 с 78.2%[1].

Цены на Claude Opus 4.8

Цены указаны за миллион токенов (MTok) и не изменились относительно Opus 4.7[1][3]:

ПозицияЦена / MTok
Вход$5
Выход$25
Чтение из кеша$0.50
Запись в кеш (5 минут)$6.25
Запись в кеш (1 час)$10
Batch-вход$2.50
Batch-выход$12.50
Вход в быстром режиме$10
Выход в быстром режиме$50

Batch API работает по половине стандартной цены на вход и выход, а кеширование промптов делает повторное чтение уже отправленного контекста дешёвым — $0.50 за миллион токенов[3].

Как получить доступ к Claude Opus 4.8

Вызывать Claude Opus 4.8 можно напрямую через Anthropic либо через OpenAI-совместимый шлюз reAPI по стандартным тарифам Anthropic. Актуальные тарифы и песочница есть на странице reapi.ai/models/claude-opus-4-8. Выгода шлюза — один ключ и один клиент на всех провайдеров: та же интеграция, которая вызывает GPT-5 и Gemini, а заодно модели reAPI для изображений и видео, вызывает и Claude Opus 4.8.

Направьте OpenAI SDK на reAPI и укажите модель:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_REAPI_KEY",
    base_url="https://api.reapi.ai/v1",
)

resp = client.chat.completions.create(
    model="claude-opus-4-8",
    messages=[
        {"role": "user", "content": "Refactor this function and explain the change."},
    ],
    extra_body={"group": "default"},
)
print(resp.choices[0].message.content)

Нативный интерфейс Anthropic /v1/messages тоже доступен, так что SDK, написанные под любой из двух форматов, работают без переделки. Вход стоит $5 за миллион токенов, выход — $25: те же ставки, что Anthropic берёт напрямую.

Кому подойдёт Claude Opus 4.8

Opus 4.8 сделан для задач, где ошибка стоит дорого, а контекст велик:

  • Агентное кодирование. Долгие задачи, в которых модель планирует, правит код и проверяет собственную работу, а выигрыш в честности сокращает число незамеченных багов.
  • Анализ на большом контексте. Чтение целой кодовой базы или набора документов за один запрос — вплоть до миллиона токенов.
  • Агенты с инструментами. Сценарии, где нужно вызывать инструменты, читать скриншоты и удерживать состояние на протяжении многих шагов.
  • Рассуждения с высокой ценой ошибки. Исследования, финансовый анализ и другая работа, где честно обозначенная неуверенность лучше уверенного неверного ответа.

Для массовых несложных вызовов обычно выгоднее модель поменьше и подешевле; Opus — тот уровень, к которому обращаются, когда возможности важнее стоимости токена.

Почему Claude Opus 4.8 важен в 2026 году

Интереснее всего в Opus 4.8 не отдельный бенчмарк. Интересно то, что Anthropic потратила целый релиз на надёжность и снизила частоту, с которой модель пропускает собственные ошибки, вместо гонки за строчкой в рейтинге. В агентном кодировании, где модель правит настоящий код на протяжении многих шагов, такая честность накапливается: меньше тихих багов всплывает потом. Вместе с окном на миллион токенов и подешевевшим быстрым режимом Opus 4.8 нацелен прямо на команды, которые строят агентов и вынуждены им доверять.

FAQ

Когда вышел Claude Opus 4.8?

28 мая 2026 года, как обновление Claude Opus 4.7 и по той же цене[1].

Какое контекстное окно у Claude Opus 4.8?

1 млн токенов, и всё окно тарифицируется по стандартной ставке за токен. Максимальный вывод — 128K токенов, а через Batch API до 300K[2].

Сколько стоит Claude Opus 4.8?

$5 за миллион входных токенов и $25 за миллион выходных, чтение из кеша — $0.50, Batch API — за полцены[3]. В быстром режиме вход стоит $10, выход — $50[1].

Мультимодален ли Claude Opus 4.8?

Он принимает на вход текст и изображения, а отдаёт текст; зрение поддерживается. Аудио и видео на входе Anthropic для этой модели не заявляет[2].

Чем Claude Opus 4.8 отличается от Opus 4.7?

Цена та же, зато выше честность (примерно вчетверо реже пропускает ошибки в собственном коде), быстрый режим стал дешевле и быстрее, и по всему набору бенчмарков Anthropic есть небольшой прирост[1].

Как вызвать Claude Opus 4.8 через OpenAI SDK?

Направьте клиент OpenAI на https://api.reapi.ai/v1, задайте в model значение claude-opus-4-8 и отправьте обычный чат-запрос. reAPI отдаёт Claude через OpenAI-совместимый эндпоинт по стандартным тарифам Anthropic.

Коротко

Claude Opus 4.8 — обновление постепенное, но реальное: та же цена, что у Opus 4.7, контекст на миллион токенов и осознанная ставка на честность, которая сильнее всего окупается в агентном кодировании. Если вы строите агентов, которые правят код или рассуждают на большом контексте, Claude Opus 4.8 — текущая вершина линейки Anthropic, и добраться до неё можно через OpenAI-совместимый API вместе со всеми остальными моделями, которые вы вызываете.

Further reading

  • reapi.ai/docs/claude-opus-4-8 — справочник по эндпоинтам и примеры для SDK.
  • What is reAPI? — единый API с одним ключом для чата, изображений и видео.
  • reapi.ai/models — весь каталог моделей.

References

  1. Anthropic. Introducing Claude Opus 4.8. Retrieved May 2026 from anthropic.com/news/claude-opus-4-8
  2. Anthropic. Models overview — context, output, modality, and capabilities. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/models/overview
  3. Anthropic. Pricing — token, cache, and batch rates. Retrieved May 2026 from platform.claude.com/docs/en/about-claude/pricing