Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 por segundo

API de DeepSeek V4 — Flash y Pro, contexto de 1M tokens

La API de DeepSeek V4 ofrece dos modelos open-weight en un único endpoint compatible con OpenAI: Flash para tareas rápidas y económicas del día a día, y Pro para razonamiento de frontera, coding agéntico y STEM. Ambos cuentan con una ventana de contexto de 1M tokens, hasta 384K de salida, modo de pensamiento activado por defecto, entrada de visión, uso de herramientas y caché de contexto. Pago por uso en USD.

DeepSeek V4modeldeepseek-v4-flash

Playground de DeepSeek V4

Los modelos de chat se ejecutan en la pasarela api.reapi.ai, que tiene su propia consola y su propia clave. Abre la consola para ejecutar DeepSeek V4 a través de la interfaz Chat Completions compatible con OpenAI.

¿Qué es la API de DeepSeek V4?

DeepSeek V4 es la generación más reciente de modelos open-weight de DeepSeek y en reAPI se expone en un único endpoint /v1/chat/completions compatible con OpenAI que sirve dos variantes: deepseek-v4-flash (284B totales / 13B activos, MoE) para el trabajo diario rápido y económico, y deepseek-v4-pro (1,6T totales / 49B activos, MoE) para razonamiento de frontera y coding agéntico. Ambas leen una ventana de contexto de 1M tokens, devuelven hasta 384K tokens por llamada, piensan antes de responder por defecto y admiten entrada de visión, uso de herramientas y caché de contexto. La facturación es por 1M tokens, con entrada y salida tarifadas por separado y un precio menor para la entrada en caché.

Lo que puedes construir con este modelo

Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

DeepSeek V4 Pro impulsando una sesión de coding agéntico de largo alcance

Coding agéntico de largo alcance con DeepSeek V4 Pro

DeepSeek V4 Pro es el buque insignia de la API de DeepSeek V4: un modelo mixture-of-experts de 1.6T parámetros (49B activos) ajustado para coding agéntico, razonamiento complejo y STEM. DeepSeek reporta resultados open-source de primer nivel en benchmarks de coding agéntico, y V4 está integrado con harnesses de agentes como Claude Code, OpenClaw y OpenCode. Apunta un agente de coding a la API de DeepSeek V4 y este define el alcance de la tarea, llama a las herramientas y razona a través de trabajo de varios pasos en una sola ejecución.

Leer la documentación de la API
DeepSeek V4 Flash potenciando coding de alto rendimiento y trabajos por lotes

Trabajo de alto rendimiento y bajo coste con DeepSeek V4 Flash

DeepSeek V4 Flash es el carril rápido de la API de DeepSeek V4: 284B parámetros (13B activos) cuyo razonamiento se acerca mucho al de Pro a una fracción del coste. Usa la API de DeepSeek V4 para autocompletado en el IDE, sugerencias en línea, revisión de código en la fase de CI, resúmenes masivos y backends de chat. La caché de contexto recorta los prompts de sistema y los esquemas de herramientas repetidos a la baja tarifa de acierto de caché, de modo que los bucles de agentes y el tráfico de alto volumen se mantienen baratos.

DeepSeek V4 razonando sobre un dossier de análisis de un millón de tokens

Análisis de bases de código y documentos de un millón de tokens

Ambos modelos de la API de DeepSeek V4 usan por defecto una ventana de contexto de 1M tokens, suficiente para cargar un repositorio mediano entero, un dossier de investigación extenso o una traza de agente de varios turnos en una sola llamada. DeepSeek Sparse Attention mantiene eficiente la inferencia con contexto largo, así que cargas de la API de DeepSeek V4 como la revisión de arquitectura, las auditorías de dependencias y la planificación de migraciones rara vez necesitan fragmentación.

Precios

Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.

Coste de la primera prueba
$0.0033 credits

Una generación en el nivel más barato (1M tokens).

Guía de presupuesto de pruebas
Añadir créditos
$10
≈ 3571 pruebas
$50
≈ 17857 pruebas
$100
≈ 35714 pruebas
ModeloCategoríaPrecio
DeepSeek V4 FlashEntrada (sin caché)
$0.14
1M tokens
Entrada (con caché)
$0.0028
1M tokens
Salida
$0.28
1M tokens
DeepSeek V4 ProEntrada (sin caché)
$1.74
1M tokens
Entrada (con caché)
$0.0145
1M tokens
Salida
$3.48
1M tokens

Por qué reAPI

Reemplazo directo compatible con OpenAI, más una superficie Anthropic

La API de DeepSeek V4 habla OpenAI Chat Completions al pie de la letra. Migrar una integración OpenAI existente a la API de DeepSeek V4 es cuestión de cambiar la base URL, la clave API y la cadena del modelo (`deepseek-v4-flash` o `deepseek-v4-pro`), no de reescribir la plataforma. El mismo array `messages`, el mismo formato de streaming y una superficie nativa al estilo Anthropic para quienes prefieran llamar desde ese SDK.

Razonamiento de frontera a precio de valor

La API de DeepSeek V4 es open-weight y su precio lo refleja. Pro rivaliza con los mejores modelos cerrados en razonamiento, matemáticas y coding, costando una fracción de ellos por token; Flash baja el precio otro orden de magnitud para el tráfico del día a día. Ejecuta el trabajo premium en Pro y enruta las llamadas de alto volumen a Flash con la misma clave.

Una sola clave para DeepSeek, GPT, Claude y Gemini

Una única clave de api.reapi.ai desbloquea la API de DeepSeek V4 junto a GPT-5.5, Claude Opus 4.8, Gemini y el resto de modelos de chat de frontera de la plataforma. Compara proveedores, añade fallbacks y enruta el tráfico por llamada con un cambio de configuración en lugar de un proyecto de integración.

DeepSeek V4 frente a DeepSeek V3.2

La API de DeepSeek V4 es un salto generacional respecto a V3.2: una ventana de contexto mayor, dos niveles de modelo, pensamiento activado por defecto, visión y un ajuste centrado en agentes. Esto es lo que cambió entre ambos.

Capacidad
API de DeepSeek V4 en reAPI
DeepSeek V3.2
Gama de modelos
Dos variantes — Flash (284B / 13B activos) y Pro (1.6T / 49B activos) — con la misma clave API.
Una única línea de modelo de chat / razonador.
Ventana de contexto
1M tokens por defecto, con DeepSeek Sparse Attention para un contexto largo eficiente.
Ventana de contexto de 128K tokens.
Salida máxima
Hasta 384K tokens de salida por respuesta.
Límite de salida sustancialmente menor.
Modo de pensamiento
Activado por defecto, con un conmutador dual de pensamiento / sin pensamiento y la cadena de pensamiento en `reasoning_content`.
Razonamiento disponible a través de un modelo razonador aparte.
Entrada de visión
Entrada de imagen admitida (beta) en el mismo endpoint.
Solo texto.
Ajuste agéntico
Optimizaciones de agente específicas; integrado con los principales harnesses de agentes de coding; SOTA open-source en coding agéntico según DeepSeek.
Modelo general competente, sin el ajuste específico para agentes de V4.

La comparativa refleja el comportamiento documentado públicamente en las notas de la versión V4 de DeepSeek y la documentación del modelo en el momento de redactar este texto. Algunas cifras de benchmarks las reporta el proveedor. El comportamiento y los precios del modelo pueden cambiar; consulta la tarjeta de precios de arriba y la documentación de la API para ver los valores actuales.

Lanza con la API de DeepSeek V4 en tres pasos

  1. step 01

    Crea una cuenta y una clave en api.reapi.ai

    Regístrate en api.reapi.ai, abre la consola, genera una clave API en API Keys y recarga tokens en Top Up. El espacio de trabajo de chat es independiente del gateway de imagen/vídeo de reapi.ai: las claves no se comparten entre ambos.

    Abrir
  2. step 02

    Envía tu primera petición

    Haz un POST a https://api.reapi.ai/v1/chat/completions con `model` puesto en `deepseek-v4-flash` (o `deepseek-v4-pro`), tu array `messages` y `max_tokens`. El endpoint de la API de DeepSeek V4 es compatible con OpenAI, incluidas las respuestas en streaming; cambia de modelo con una sola línea.

    Abrir
  3. step 03

    Ajusta para coste y razonamiento

    En la API de DeepSeek V4, recurre a Flash para trabajo de alto rendimiento sensible a la latencia y a Pro cuando una tarea requiera razonamiento profundo. Reutiliza prompts de sistema estables para alcanzar la baja tarifa de lectura de caché, y desactiva el modo de pensamiento para obtener las respuestas más rápidas y económicas.

    Abrir
docs/api/deepseek-v4

Referencia de API

Código listo para usar y la tabla completa de parámetros.

curl https://api.reapi.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "group": "default",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "stream": true,
    "max_tokens": 4096,
    "temperature": 0.7
  }'

Validación de parámetros fallida

Rechazado de forma síncrona con el campo problemático indicado. Revisa enums, rangos y campos de URL — no se cobra nada.

Problema de autenticación o saldo

401 significa clave Bearer ausente o inválida; 402, que la reserva supera tu saldo. Gestiona claves y créditos en la consola.

Contenido o material rechazado

El material de referencia y las salidas pasan una moderación automática. Las tareas rechazadas fallan con un error claro y reembolso completo.

Tarea fallida o con timeout

Una tarea que llega a estado fallido nunca se cobra: la reserva se reembolsa automáticamente. Guarda el ID y reintenta.

Preguntas frecuentes

Dudas comunes sobre este modelo.

La API de DeepSeek V4 se factura por uso en USD contra tu saldo de tokens de api.reapi.ai. La tarjeta de precios de esta página muestra las tarifas en vivo de entrada y salida por 1M tokens para Flash y Pro, además de la tarifa de acierto de caché. Los aciertos de caché son drásticamente más baratos que reenviar los mismos tokens, y las peticiones fallidas no se cobran.

start building

¿Listo para lanzar?

Pruébalo en el playground o consigue una API key para integrarlo ahora.