
MiniMax
MiniMax M3
À partir de $0.600 par 1M de tokens
L'API DeepSeek V4 propose deux modèles à poids ouverts sur un seul endpoint compatible OpenAI — Flash pour le travail quotidien rapide et économique, Pro pour le raisonnement de pointe, le codage agentique et les sciences. Tous deux offrent une fenêtre de contexte de 1 M de tokens, jusqu'à 384 K de sortie, le mode réflexion activé par défaut, l'entrée visuelle, l'usage d'outils et la mise en cache du contexte. Paiement à l'usage en USD.
Commencez avec le texte du champ de saisie ou choisissez un exemple.
DeepSeek V4 est la dernière génération de modèles à poids ouverts de DeepSeek, exposée sur reAPI via un seul endpoint /v1/chat/completions compatible OpenAI qui porte deux variantes : deepseek-v4-flash (284B au total / 13B actifs, MoE) pour le travail quotidien rapide et économique, et deepseek-v4-pro (1,6T au total / 49B actifs, MoE) pour le raisonnement de pointe et le codage agentique. Les deux lisent une fenêtre de contexte de 1M de tokens, renvoient jusqu'à 384K tokens par appel, réfléchissent par défaut avant de répondre et acceptent l'entrée visuelle, les appels d'outils et la mise en cache du contexte. La facturation se fait par 1M de tokens, entrée et sortie tarifées séparément, avec un tarif réduit pour l'entrée servie depuis le cache.
Des workflows réels et des cas d'usage en production que tu peux construire et déployer avec ce modèle.

DeepSeek V4 Pro est le modèle phare de l'API DeepSeek V4 — un modèle mixture-of-experts de 1,6 T de paramètres (49 Md actifs) optimisé pour le codage agentique, le raisonnement complexe et les sciences. DeepSeek annonce des résultats open source à l'état de l'art sur les benchmarks de codage agentique, et V4 s'intègre à des harnais d'agents comme Claude Code, OpenClaw et OpenCode. Branchez un agent de codage sur l'API DeepSeek V4 : il cadre la tâche, appelle les outils et raisonne sur un travail en plusieurs étapes en une seule exécution.
Lire la doc API
DeepSeek V4 Flash est la voie rapide de l'API DeepSeek V4 — 284 Md de paramètres (13 Md actifs) dont le raisonnement frôle celui de Pro pour une fraction du coût. Utilisez l'API DeepSeek V4 pour l'autocomplétion dans l'IDE, les suggestions en ligne, la revue de code en phase CI, le résumé en masse et les backends de chat. La mise en cache du contexte ramène les prompts système et schémas d'outils répétés au faible tarif des cache hits, gardant les boucles d'agents et le trafic à fort volume bon marché.

Les deux modèles de l'API DeepSeek V4 utilisent par défaut une fenêtre de contexte de 1 M de tokens — assez pour charger un dépôt de taille moyenne complet, un long dossier de recherche ou une trace d'agent multi-tour en un seul appel. DeepSeek Sparse Attention maintient l'inférence à long contexte efficace, si bien que les charges de l'API DeepSeek V4 comme la revue d'architecture, l'audit de dépendances et la planification de migration n'ont presque jamais besoin de découpage.
Basé sur les crédits — 1 crédit = 0,001 USD. Tu ne paies que les générations réussies.
Une génération au palier le moins cher (1M tokens).
| Modèle | Catégorie | Prix |
|---|---|---|
| DeepSeek V4 Flash | Entrée (cache miss) | $0.1 1M tokens |
| Entrée (cache hit) | $0.0028 1M tokens | |
| Sortie | $0.2 1M tokens | |
| DeepSeek V4 Pro | Entrée (cache miss) | $0.4 1M tokens |
| Entrée (cache hit) | $0.0145 1M tokens | |
| Sortie | $0.9 1M tokens |
L'API DeepSeek V4 parle OpenAI Chat Completions mot pour mot. Migrer une intégration OpenAI existante vers l'API DeepSeek V4 se résume à une URL de base, une clé API et un changement de chaîne de modèle — `deepseek-v4-flash` ou `deepseek-v4-pro` — sans réécriture de plateforme. Le même tableau `messages`, le même format de streaming, et une surface native de style Anthropic pour les appelants SDK qui la préfèrent.
L'API DeepSeek V4 est à poids ouverts et tarifée en conséquence. Pro rivalise avec les meilleurs modèles propriétaires en raisonnement, mathématiques et codage tout en coûtant une fraction de leur prix au token ; Flash réduit encore le prix d'un ordre de grandeur pour le trafic courant. Faites tourner le travail premium sur Pro et routez les appels à fort volume vers Flash avec la même clé.
Une seule clé api.reapi.ai débloque l'API DeepSeek V4 aux côtés de GPT-5.5, Claude Opus 4.8, Gemini et tous les autres modèles de chat de pointe de la plateforme. Comparez les fournisseurs, ajoutez des solutions de repli et routez le trafic appel par appel avec un changement de configuration au lieu d'un projet d'intégration.
L'API DeepSeek V4 marque un saut générationnel par rapport à V3.2 — fenêtre de contexte plus grande, deux paliers de modèles, réflexion activée par défaut, vision et optimisation pour les agents. Voici ce qui a changé entre les deux.
La comparaison reflète le comportement publiquement documenté dans les notes de version V4 de DeepSeek et la documentation des modèles au moment de la rédaction. Certaines affirmations de benchmark proviennent du fournisseur. Le comportement des modèles et les tarifs peuvent changer ; consultez la grille tarifaire ci-dessus et la doc API pour les valeurs actuelles.
Inscrivez-vous sur api.reapi.ai, ouvrez la console, générez une clé API sous API Keys et créditez des tokens sous Top Up. L'espace de travail chat est distinct de la passerelle image/vidéo de reapi.ai — les clés ne sont pas interchangeables.
OuvrirPOST https://api.reapi.ai/v1/chat/completions avec `model` réglé sur `deepseek-v4-flash` (ou `deepseek-v4-pro`), votre tableau `messages` et `max_tokens`. L'endpoint de l'API DeepSeek V4 est compatible OpenAI, réponses en flux comprises ; changez de modèle en modifiant une seule ligne.
OuvrirSur l'API DeepSeek V4, optez pour Flash sur le travail sensible à la latence et à haut débit, et pour Pro lorsqu'une tâche exige un raisonnement profond. Réutilisez des prompts système stables pour atteindre le faible tarif de lecture en cache, et désactivez le mode réflexion pour les réponses les plus rapides et les moins chères.
Ouvrircurl https://api.reapi.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"group": "default",
"messages": [
{ "role": "user", "content": "Hello" }
],
"stream": true,
"max_tokens": 4096,
"temperature": 0.7
}'Rejet synchrone avec le champ fautif nommé. Vérifiez enums, plages et champs URL — rien n'est facturé.
401 : clé Bearer absente ou invalide ; 402 : la réserve dépasse votre solde. Gérez clés et crédits dans la console.
Le matériel de référence et les sorties passent une modération automatique. Les tâches rejetées échouent avec une erreur claire et un remboursement intégral.
Une tâche en état d'échec n'est jamais facturée — la réserve est remboursée automatiquement. Conservez l'ID et réessayez.
Questions courantes sur ce modèle.
Explorez d’autres modèles de la même catégorie.

MiniMax
À partir de $0.600 par 1M de tokens

À partir de $0.585 par million de tokens

Z.AI
À partir de $0.900 par 1M de tokens

OpenAI
À partir de $0.800 par 1M de tokens
Essaie-le dans le playground ou récupère une clé API pour intégrer dès maintenant.