GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone

deepseek-v4.1-flash — contexto de 1M, salida de 384K, visión

deepseek-v4.1-flash es como reAPI sirve los pesos DeepSeek-V4.1-Flash en su endpoint de chat compatible con OpenAI. deepseek-v4.1-flash lee una ventana de contexto de 1M tokens y puede escribir hasta 384.000 tokens en una sola respuesta, piensa por defecto en tres peldaños de esfuerzo y acepta imágenes junto con texto. Las tarifas actuales de deepseek-v4.1-flash están en la tabla de precios de esta página.

Características
Contexto de 1M · salida máxima de 384.000 · visión · thinking activado por defecto
Ideal para
Documentos largos, análisis de repositorios, lectura de gráficos y capturas de pantalla
Entrada
Mensajes de chat, texto e imagen (compatible con OpenAI)
Salida
Texto, streaming opcional
DeepSeek V4.1 Flash

Preguntar a DeepSeek V4.1 Flash

Empieza con el texto del compositor o elige un ejemplo.

Enter para enviar · Mayús+Enter para una nueva línea

Precios

Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.

Coste de la primera prueba
$0.00171.7 credits

Un prompt de 1K tokens con una respuesta de 1K tokens en el nivel más barato.

Guía de presupuesto de pruebas
Añadir créditos
$10
≈ 5882 pruebas
$50
≈ 29411 pruebas
$100
≈ 58823 pruebas
Entrada
$0.400
Precio · 1M tokens
Salida
$1.300
Precio · 1M tokens
Lectura de caché
$0.015
Precio · 1M tokens

¿Qué es deepseek-v4.1-flash?

deepseek-v4.1-flash es como reAPI sirve los pesos V4.1-Flash de DeepSeek a través de un endpoint /api/v1/chat/completions compatible con OpenAI. La propia tabla de Modelos y Precios de DeepSeek le da a la línea Flash una ventana de contexto de 1M tokens, un máximo documentado de 384K tokens de salida, visión, salida JSON y llamadas a herramientas, además de modo thinking y modo sin thinking. El thinking está activado por defecto con esfuerzo high. Lo que hace inusual a deepseek-v4.1-flash en su categoría es el lado de la salida: la mayoría de los niveles rápidos limitan la generación muy por debajo de su ventana de contexto, mientras que deepseek-v4.1-flash puede seguir escribiendo hasta 384.000 tokens, que es justo lo que necesita una pasada de traducción completa o una refactorización archivo por archivo. La facturación es por token desde tu saldo de reAPI, con entrada, salida y lecturas de caché cada una con su propia tarifa.

Lo que puedes construir con este modelo

Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

deepseek-v4.1-flash procesando un documento largo en una sola pasada

Pasadas completas de documentos y repositorios

Una ventana de contexto de 1M tokens es solo la mitad de un trabajo largo; la otra mitad es que te dejen escribir la respuesta entera. deepseek-v4.1-flash combina esa ventana con un techo de salida de 384.000 tokens, así que un manual traducido, una suite de pruebas reescrita o una revisión de contrato cláusula por cláusula pueden volver en una sola respuesta en lugar de trocearse, coserse y reconciliarse. Como deepseek-v4.1-flash cobra lo mismo a cualquier longitud de contexto, un prompt largo no cruza ningún umbral que cambie la tarifa a mitad de trabajo. Fija max_tokens deliberadamente en estos trabajos — deepseek-v4.1-flash usa el valor por defecto del endpoint si no, no el techo.

Leer la documentación de la API
deepseek-v4.1-flash leyendo un gráfico y una captura de pantalla

Gráficos, capturas de pantalla y páginas escaneadas

deepseek-v4.1-flash acepta imágenes en el mismo endpoint y con la misma forma de petición que el texto. DeepSeek admite JPEG, PNG, GIF y WebP, y detecta el formato a partir de los bytes reales del archivo en lugar de su nombre o el MIME type declarado, así que una subida mal etiquetada sigue funcionando. Envía una imagen a deepseek-v4.1-flash en línea como una data URL en base64, como un enlace http(s) público que el modelo descarga por ti, o como un handle de la Files API. Eso cubre las dos formas en las que normalmente llega este trabajo: una captura de pantalla local y una URL que ya está en tu pipeline.

deepseek-v4.1-flash convirtiendo un formulario escaneado en JSON estructurado

Extracción estructurada que se mantiene estructurada

DeepSeek documenta la salida JSON y las llamadas a herramientas como funciones admitidas de los pesos Flash, así que pedirle a deepseek-v4.1-flash una salida legible por máquina es un contrato y no un truco de prompt. Combinado con visión, eso hace que deepseek-v4.1-flash encaje para convertir facturas escaneadas, dashboards y formularios en filas de datos. Una advertencia que conviene saber antes de construir el bucle: cuando una petición lleva tools, el texto de razonamiento que devuelve deepseek-v4.1-flash debe repetirse en los turnos siguientes; sin tools se ignora y se puede descartar.

Por qué reAPI para DeepSeek V4.1 Flash

Un techo de salida a la altura de la ventana

Los niveles rápidos suelen anunciar una ventana de contexto grande y luego limitan la generación un orden de magnitud por debajo. DeepSeek documenta un máximo de 384K tokens de salida para los pesos Flash, así que deepseek-v4.1-flash puede devolver trabajo a la misma escala en la que lo lee. Para traducciones, refactorizaciones y extracciones estructuradas largas, esa es la diferencia entre una sola petición y un pipeline de troceado que tienes que escribir, ajustar y depurar tú mismo.

Visión en el mismo endpoint

deepseek-v4.1-flash acepta imágenes en el formato estándar de bloques de contenido de OpenAI — sin endpoint de visión separado, sin base URL distinta, sin un segundo model id al que enrutar. Las imágenes pueden ir en línea como base64, como una URL pública que deepseek-v4.1-flash descarga, o como un handle de la Files API, y DeepSeek identifica el formato a partir del contenido del archivo y no del nombre. Añadir comprensión de imágenes a una integración de texto ya existente es un cambio en el cuerpo del mensaje y nada más.

Una clave para todos los modelos de la plataforma

La misma clave de reAPI y el mismo saldo que llaman a deepseek-v4.1-flash también llaman a las familias Claude, GPT, Gemini y Kimi. Poner a deepseek-v4.1-flash cara a cara con otro modelo, o hacer failover cuando un proveedor tiene una mala hora, es un cambio en una cadena de modelo en lugar de una segunda integración, una segunda factura y un segundo juego de credenciales que rotar.

deepseek-v4.1-flash frente a GPT-5.6 Luna

La decisión real para un nivel sensible al coste con una ventana de contexto muy grande. Los dos aceptan texto e imágenes y los dos exponen un dial de razonamiento, así que la comparación no es sobre cuál es mejor en general — es sobre el techo de salida, cómo tarifa cada uno un prompt largo, y cuánto control tienes sobre el thinking. La fila de tarifa lo dice sin rodeos: Luna es el más barato de los dos.

Capacidad
deepseek-v4.1-flash en reAPI
GPT-5.6 Luna
Ventana de contexto
1M tokens, documentado por DeepSeek para los pesos Flash
1,05M tokens, documentado por OpenAI
Tokens de salida máximos
384.000 — aproximadamente tres veces el rival, y la razón por la que una pasada completa puede volver en una sola respuesta
128.000
Tarifa en prompts largos
Una tarifa a cualquier longitud de contexto; un prompt largo nunca cruza un umbral de precio
Se aplica un segundo nivel, más alto, en cuanto un prompt supera el umbral documentado
Control de razonamiento
Tres peldaños — low, high, max — con high por defecto; los demás peldaños se aceptan y se mapean sobre estos
Seis peldaños, incluido none, así que el thinking se puede desactivar por completo
Entrada de imagen
Base64 en línea, una URL pública que se descarga por ti, o un handle de la Files API; el formato se lee del contenido del archivo
Las imágenes se aceptan en sus dimensiones originales
Tarifa por token
Más alta que el rival tanto en entrada como en salida; las cifras en vivo están en la tabla de arriba
Más baja tanto en entrada como en salida

La comparación refleja el comportamiento documentado por DeepSeek y OpenAI en el momento de escribir. Las tarifas se describen como relaciones en lugar de importes; los números en vivo están en la tabla de precios de arriba y en la página propia de cada modelo.

Lanza deepseek-v4.1-flash en tres pasos

  1. step 01

    Crea una API key de reAPI

    Regístrate y genera una clave en tu dashboard. Las cuentas nuevas empiezan con crédito ya aplicado, suficiente para enviar peticiones reales y ver una factura real antes de recargar.

    Abrir
  2. step 02

    Apunta tu base URL a reAPI

    Mantén tu cliente de OpenAI. Cambia la base URL a reapi.ai/api/v1 y la cadena de modelo a deepseek-v4.1-flash — deepseek-v4.1-flash habla el mismo contrato de Chat Completions, así que nada más cambia en el punto donde haces la llamada.

    Abrir
  3. step 03

    Envía messages y lee la respuesta

    Haz POST de tu array messages y lee choices[0].message. deepseek-v4.1-flash devuelve su razonamiento en reasoning_content junto a content, y usage reporta los tokens de entrada, salida y caché por separado.

    Abrir
docs/api/deepseek-v4-1-flash

Referencia de API

Código listo para usar y la tabla completa de parámetros.

curl https://reapi.ai/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "high",
    "max_tokens": 8192,
    "stream": true
  }'

Validación de parámetros fallida

Rechazado de forma síncrona con el campo problemático indicado. Revisa enums, rangos y campos de URL — no se cobra nada.

Problema de autenticación o saldo

401 significa clave Bearer ausente o inválida; 402, que la reserva supera tu saldo. Gestiona claves y créditos en la consola.

Contenido o material rechazado

El material de referencia y las salidas pasan una moderación automática. Las tareas rechazadas fallan con un error claro y reembolso completo.

Tarea fallida o con timeout

Una tarea que llega a estado fallido nunca se cobra: la reserva se reembolsa automáticamente. Guarda el ID y reintenta.

Preguntas frecuentes

Dudas comunes sobre este modelo.

deepseek-v4.1-flash se factura pago por uso por token desde tu saldo de reAPI, con tarifas separadas de entrada, salida y lectura de caché, y sin suscripción. La tarifa no sube con la longitud del contexto, y los tokens de razonamiento cuentan como salida. Las cifras actuales están en la tabla de precios de esta página.

start building

¿Listo para lanzar?

Pruébalo en el playground o consigue una API key para integrarlo ahora.