
MiniMax
MiniMax M3
От $0.600 за 1M токенов
DeepSeek V4 API даёт две open-weight модели на одном OpenAI-совместимом эндпоинте: Flash — для быстрой и недорогой повседневной работы, Pro — для передового рассуждения, агентного кодинга и STEM. У обеих контекстное окно 1M токенов, до 384K вывода, режим рассуждения включён по умолчанию, ввод изображений, вызов инструментов и кэширование контекста. Оплата по факту в долларах.
Начните с текста в поле ввода или выберите пример.
DeepSeek V4 — новейшее поколение open-weight моделей DeepSeek, доступное на reAPI через один OpenAI-совместимый эндпоинт /v1/chat/completions с двумя вариантами: deepseek-v4-flash (284B всего / 13B активных, MoE) для быстрой и недорогой повседневной работы и deepseek-v4-pro (1,6T всего / 49B активных, MoE) для передового рассуждения и агентного кодинга. Обе читают контекстное окно на 1M токенов, возвращают до 384K токенов за вызов, по умолчанию рассуждают перед ответом и поддерживают ввод изображений, вызов инструментов и кэширование контекста. Тарификация — за 1M токенов, вход и выход считаются отдельно, а для входа из кэша ставка ниже.
Реальные рабочие процессы и production-сценарии, которые ты можешь собрать и запустить на этой модели.

DeepSeek V4 Pro — флагман DeepSeek V4 API: mixture-of-experts модель на 1,6T параметров (49B активных), настроенная под агентный кодинг, сложное рассуждение и STEM. DeepSeek сообщает о результатах уровня open-source state-of-the-art в бенчмарках агентного кодинга, а V4 интегрирована с агентными оболочками вроде Claude Code, OpenClaw и OpenCode. Направьте кодинг-агента на DeepSeek V4 API — и он сам определит объём задачи, вызовет инструменты и пройдёт многошаговую работу за один прогон.
Читать документацию API
DeepSeek V4 Flash — скоростная полоса DeepSeek V4 API: 284B параметров (13B активных), чьё рассуждение вплотную приближается к Pro за долю стоимости. Используйте DeepSeek V4 API для автодополнения в IDE, встроенных подсказок, ревью кода на этапе CI, массового реферирования и чат-бэкендов. Кэширование контекста сводит повторяющиеся системные промпты и схемы инструментов к низкой ставке попадания в кэш, так что агентные циклы и высоконагруженный трафик остаются дешёвыми.

Обе модели DeepSeek V4 API по умолчанию используют контекстное окно в 1M токенов — этого хватает, чтобы загрузить целый репозиторий среднего размера, объёмную подборку исследований или многоходовую трассу агента за один вызов. DeepSeek Sparse Attention сохраняет эффективность инференса на длинном контексте, поэтому задачи DeepSeek V4 API вроде архитектурного обзора, аудита зависимостей и планирования миграции редко требуют разбивки на части.
Оплата кредитами — 1 кредит = $0.001 USD. Платишь только за успешные генерации.
Одна генерация на самом дешёвом уровне (1M tokens).
| Модель | Категория | Цена |
|---|---|---|
| DeepSeek V4 Flash | Ввод (промах кэша) | $0.1 1M tokens |
| Ввод (попадание в кэш) | $0.0028 1M tokens | |
| Вывод | $0.2 1M tokens | |
| DeepSeek V4 Pro | Ввод (промах кэша) | $0.4 1M tokens |
| Ввод (попадание в кэш) | $0.0145 1M tokens | |
| Вывод | $0.9 1M tokens |
DeepSeek V4 API дословно говорит на языке OpenAI Chat Completions. Перенос существующей интеграции с OpenAI на DeepSeek V4 API — это смена base URL, API-ключа и строки модели (`deepseek-v4-flash` или `deepseek-v4-pro`), а не переписывание платформы. Тот же массив `messages`, тот же формат стриминга и нативная поверхность в стиле Anthropic для тех, кто вызывает через SDK и предпочитает её.
DeepSeek V4 API — open-weight и оценён соответственно. Pro соперничает с топовыми закрытыми моделями в рассуждении, математике и кодинге, стоя при этом долю их цены за токен; Flash снижает цену ещё на порядок для повседневного трафика. Запускайте премиум-задачи на Pro и направляйте высоконагруженные вызовы на Flash с тем же ключом.
Единый ключ api.reapi.ai открывает DeepSeek V4 API вместе с GPT-5.5, Claude Opus 4.8, Gemini и любой другой передовой чат-моделью на платформе. Сравнивайте вендоров, добавляйте резервные варианты и маршрутизируйте трафик для каждого вызова изменением конфигурации, а не отдельным интеграционным проектом.
DeepSeek V4 API — поколенческий скачок относительно V3.2: больше контекстное окно, два уровня моделей, рассуждение по умолчанию, зрение и агентная настройка. Вот что изменилось между ними.
Сравнение отражает публично документированное поведение из release notes и документации DeepSeek по V4 на момент написания. Часть заявленных результатов бенчмарков — данные вендора. Поведение модели и цены могут меняться; смотрите карточку цен выше и документацию API для актуальных значений.
Зарегистрируйтесь на api.reapi.ai, откройте консоль, сгенерируйте API-ключ в разделе API Keys и пополните токены в разделе Top Up. Рабочее пространство чата отделено от шлюза изображений/видео reapi.ai — ключи между ними не действуют.
ОткрытьPOST на https://api.reapi.ai/v1/chat/completions с `model`, выставленным в `deepseek-v4-flash` (или `deepseek-v4-pro`), вашим массивом `messages` и `max_tokens`. Эндпоинт DeepSeek V4 API OpenAI-совместимый, включая стримовые ответы; смена модели — это правка в одну строку.
ОткрытьВ рамках DeepSeek V4 API берите Flash для задач, чувствительных к задержке и высоконагруженных, и Pro, когда нужно глубокое рассуждение. Переиспользуйте стабильные системные промпты, чтобы попадать в низкую ставку чтения из кэша, и отключайте режим рассуждения для самых быстрых и дешёвых ответов.
Открытьcurl https://api.reapi.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"group": "default",
"messages": [
{ "role": "user", "content": "Hello" }
],
"stream": true,
"max_tokens": 4096,
"temperature": 0.7
}'Синхронный отказ с указанием проблемного поля. Проверьте значения enum, диапазоны и URL-поля — ничего не списывается.
401 — отсутствует или неверен Bearer-ключ; 402 — резерв превышает баланс. Ключи и кредиты — в консоли.
Референсные материалы и результаты проходят автоматическую модерацию. Отклонённые задачи завершаются понятной ошибкой с полным возвратом.
Задача в состоянии сбоя никогда не тарифицируется — резерв возвращается автоматически. Сохраните ID задачи и повторите.
Распространённые вопросы об этой модели.
Попробуй в playground или получи API-ключ для интеграции прямо сейчас.