Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references

DeepSeek V4 API — Flash и Pro, контекст 1M

DeepSeek V4 API даёт две open-weight модели на одном OpenAI-совместимом эндпоинте: Flash — для быстрой и недорогой повседневной работы, Pro — для передового рассуждения, агентного кодинга и STEM. У обеих контекстное окно 1M токенов, до 384K вывода, режим рассуждения включён по умолчанию, ввод изображений, вызов инструментов и кэширование контекста. Оплата по факту в долларах.

Особенности
Флагман с открытыми весами · штрафные элементы управления
Для чего
Экономичное рассуждение, кодирование
Вход
Сообщения чата (совместимо с OpenAI)
Выход
Текст, потоковая передача опциональна
DeepSeek V4

Спросить DeepSeek V4

Начните с текста в поле ввода или выберите пример.

Enter — отправить · Shift+Enter — новая строка

Что такое DeepSeek V4 API?

DeepSeek V4 — новейшее поколение open-weight моделей DeepSeek, доступное на reAPI через один OpenAI-совместимый эндпоинт /v1/chat/completions с двумя вариантами: deepseek-v4-flash (284B всего / 13B активных, MoE) для быстрой и недорогой повседневной работы и deepseek-v4-pro (1,6T всего / 49B активных, MoE) для передового рассуждения и агентного кодинга. Обе читают контекстное окно на 1M токенов, возвращают до 384K токенов за вызов, по умолчанию рассуждают перед ответом и поддерживают ввод изображений, вызов инструментов и кэширование контекста. Тарификация — за 1M токенов, вход и выход считаются отдельно, а для входа из кэша ставка ниже.

Что можно создать на этой модели

Реальные рабочие процессы и production-сценарии, которые ты можешь собрать и запустить на этой модели.

DeepSeek V4 Pro ведёт долгую сессию агентного кодинга

Долгосрочный агентный кодинг с DeepSeek V4 Pro

DeepSeek V4 Pro — флагман DeepSeek V4 API: mixture-of-experts модель на 1,6T параметров (49B активных), настроенная под агентный кодинг, сложное рассуждение и STEM. DeepSeek сообщает о результатах уровня open-source state-of-the-art в бенчмарках агентного кодинга, а V4 интегрирована с агентными оболочками вроде Claude Code, OpenClaw и OpenCode. Направьте кодинг-агента на DeepSeek V4 API — и он сам определит объём задачи, вызовет инструменты и пройдёт многошаговую работу за один прогон.

Читать документацию API
DeepSeek V4 Flash питает высоконагруженный кодинг и пакетные задачи

Высокая пропускная способность и низкая цена с DeepSeek V4 Flash

DeepSeek V4 Flash — скоростная полоса DeepSeek V4 API: 284B параметров (13B активных), чьё рассуждение вплотную приближается к Pro за долю стоимости. Используйте DeepSeek V4 API для автодополнения в IDE, встроенных подсказок, ревью кода на этапе CI, массового реферирования и чат-бэкендов. Кэширование контекста сводит повторяющиеся системные промпты и схемы инструментов к низкой ставке попадания в кэш, так что агентные циклы и высоконагруженный трафик остаются дешёвыми.

DeepSeek V4 рассуждает по подборке для анализа на миллион токенов

Анализ кодовых баз и документов на миллион токенов

Обе модели DeepSeek V4 API по умолчанию используют контекстное окно в 1M токенов — этого хватает, чтобы загрузить целый репозиторий среднего размера, объёмную подборку исследований или многоходовую трассу агента за один вызов. DeepSeek Sparse Attention сохраняет эффективность инференса на длинном контексте, поэтому задачи DeepSeek V4 API вроде архитектурного обзора, аудита зависимостей и планирования миграции редко требуют разбивки на части.

Цены

Оплата кредитами — 1 кредит = $0.001 USD. Платишь только за успешные генерации.

Стоимость первого теста
$0.0033 credits

Одна генерация на самом дешёвом уровне (1M tokens).

Гид по бюджету тестирования
Пополнить кредиты
$10
≈ 3571 тестов
$50
≈ 17857 тестов
$100
≈ 35714 тестов
МодельКатегорияЦена
DeepSeek V4 FlashВвод (промах кэша)
$0.1
1M tokens
Ввод (попадание в кэш)
$0.0028
1M tokens
Вывод
$0.2
1M tokens
DeepSeek V4 ProВвод (промах кэша)
$0.4
1M tokens
Ввод (попадание в кэш)
$0.0145
1M tokens
Вывод
$0.9
1M tokens

Почему reAPI

Drop-in замена OpenAI — плюс поверхность Anthropic

DeepSeek V4 API дословно говорит на языке OpenAI Chat Completions. Перенос существующей интеграции с OpenAI на DeepSeek V4 API — это смена base URL, API-ключа и строки модели (`deepseek-v4-flash` или `deepseek-v4-pro`), а не переписывание платформы. Тот же массив `messages`, тот же формат стриминга и нативная поверхность в стиле Anthropic для тех, кто вызывает через SDK и предпочитает её.

Передовое рассуждение по выгодной цене

DeepSeek V4 API — open-weight и оценён соответственно. Pro соперничает с топовыми закрытыми моделями в рассуждении, математике и кодинге, стоя при этом долю их цены за токен; Flash снижает цену ещё на порядок для повседневного трафика. Запускайте премиум-задачи на Pro и направляйте высоконагруженные вызовы на Flash с тем же ключом.

Один ключ для DeepSeek, GPT, Claude и Gemini

Единый ключ api.reapi.ai открывает DeepSeek V4 API вместе с GPT-5.5, Claude Opus 4.8, Gemini и любой другой передовой чат-моделью на платформе. Сравнивайте вендоров, добавляйте резервные варианты и маршрутизируйте трафик для каждого вызова изменением конфигурации, а не отдельным интеграционным проектом.

DeepSeek V4 против DeepSeek V3.2

DeepSeek V4 API — поколенческий скачок относительно V3.2: больше контекстное окно, два уровня моделей, рассуждение по умолчанию, зрение и агентная настройка. Вот что изменилось между ними.

Возможность
DeepSeek V4 API на reAPI
DeepSeek V3.2
Линейка моделей
Два варианта — Flash (284B / 13B активных) и Pro (1,6T / 49B активных) — на одном API-ключе.
Одна линейка чат / reasoner.
Контекстное окно
1M токенов по умолчанию, с DeepSeek Sparse Attention для эффективного длинного контекста.
Контекстное окно 128K токенов.
Макс. вывод
До 384K токенов вывода на ответ.
Заметно меньший лимит вывода.
Режим рассуждения
Включён по умолчанию, с переключателем рассуждение / без рассуждения и цепочкой рассуждений в `reasoning_content`.
Рассуждение доступно через отдельную reasoner-модель.
Ввод изображений
Поддержка ввода изображений (бета) на том же эндпоинте.
Только текст.
Агентная настройка
Специальные агентные оптимизации; интеграция с ведущими оболочками кодинг-агентов; по данным DeepSeek — open-source SOTA в агентном кодинге.
Сильная универсальная модель без агентной настройки уровня V4.

Сравнение отражает публично документированное поведение из release notes и документации DeepSeek по V4 на момент написания. Часть заявленных результатов бенчмарков — данные вендора. Поведение модели и цены могут меняться; смотрите карточку цен выше и документацию API для актуальных значений.

Запустите DeepSeek V4 API за три шага

  1. step 01

    Создайте аккаунт и ключ на api.reapi.ai

    Зарегистрируйтесь на api.reapi.ai, откройте консоль, сгенерируйте API-ключ в разделе API Keys и пополните токены в разделе Top Up. Рабочее пространство чата отделено от шлюза изображений/видео reapi.ai — ключи между ними не действуют.

    Открыть
  2. step 02

    Отправьте первый запрос

    POST на https://api.reapi.ai/v1/chat/completions с `model`, выставленным в `deepseek-v4-flash` (или `deepseek-v4-pro`), вашим массивом `messages` и `max_tokens`. Эндпоинт DeepSeek V4 API OpenAI-совместимый, включая стримовые ответы; смена модели — это правка в одну строку.

    Открыть
  3. step 03

    Настройте под цену и рассуждение

    В рамках DeepSeek V4 API берите Flash для задач, чувствительных к задержке и высоконагруженных, и Pro, когда нужно глубокое рассуждение. Переиспользуйте стабильные системные промпты, чтобы попадать в низкую ставку чтения из кэша, и отключайте режим рассуждения для самых быстрых и дешёвых ответов.

    Открыть
docs/api/deepseek-v4

Справочник API

Готовый код и полная таблица параметров.

curl https://api.reapi.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "group": "default",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "stream": true,
    "max_tokens": 4096,
    "temperature": 0.7
  }'

Ошибка валидации параметров

Синхронный отказ с указанием проблемного поля. Проверьте значения enum, диапазоны и URL-поля — ничего не списывается.

Проблема с аутентификацией или балансом

401 — отсутствует или неверен Bearer-ключ; 402 — резерв превышает баланс. Ключи и кредиты — в консоли.

Контент или материал отклонён

Референсные материалы и результаты проходят автоматическую модерацию. Отклонённые задачи завершаются понятной ошибкой с полным возвратом.

Задача не выполнена или истёк таймаут

Задача в состоянии сбоя никогда не тарифицируется — резерв возвращается автоматически. Сохраните ID задачи и повторите.

Часто задаваемые вопросы

Распространённые вопросы об этой модели.

DeepSeek V4 API тарифицируется по факту в долларах со счёта токенов на api.reapi.ai. Карточка цен на этой странице показывает актуальные ставки за 1M токенов ввода и вывода для Flash и Pro, а также ставку при попадании в кэш. Попадания в кэш заметно дешевле, чем повторная отправка тех же токенов, а за неуспешные запросы плата не взимается.

start building

Готов к запуску?

Попробуй в playground или получи API-ключ для интеграции прямо сейчас.