
OpenAI
GPT-5.4
À partir de $1.00 par 1M de tokens
GPT-5.6 Luna est le palier économique d'OpenAI dans la famille GPT-5.6, et l'intéressant est ce qu'il ne sacrifie pas : GPT-5.6 Luna dispose de la même fenêtre de contexte de 1 050 000 tokens, de la même sortie maximale de 128 000 tokens et du même cadran de raisonnement à six crans que son frère de pointe. Ce qui change, c'est le prix et la profondeur de réflexion qu'il est raisonnable de lui demander. Sur reAPI, GPT-5.6 Luna est facturé sous le tarif publié par OpenAI, en entrée comme en sortie.
Commencez avec le texte du champ de saisie ou choisissez un exemple.
GPT-5.6 Luna est le palier économique de la famille GPT-5.6, servi sur reAPI par un endpoint /api/v1/chat/completions compatible OpenAI. Il n'abandonne aucune des limites de la famille : la même fenêtre de contexte de 1 050 000 tokens, la même sortie maximale de 128 000 tokens et les mêmes six crans d'effort de raisonnement, de none à max, avec medium par défaut, en entrée texte et image et en sortie texte. La facturation se fait par 1M de tokens, entrée et sortie tarifées séparément ; les tokens de raisonnement comptent comme de la sortie.
Des workflows réels et des cas d'usage en production que tu peux construire et déployer avec ce modèle.

C'est le travail qu'OpenAI nomme pour le cran d'effort le plus bas : recherche rapide d'informations et classification, là où le raisonnement n'ajoute que de la latence. Coupez l'effort, contraignez la sortie par un schéma, et GPT-5.6 Luna devient un composant plutôt qu'un oracle : le même prompt sur un million de lignes, à un tarif où le calcul tient encore. Le point à remarquer est que descendre sur ce palier ne réduit pas vos entrées : GPT-5.6 Luna lit la même fenêtre de 1 050 000 tokens que le palier de pointe, un long document ne vous force donc pas à remonter l'échelle des prix juste pour tenir.
Lire la doc API
L'essentiel du trafic de production n'est pas difficile. Une route en deux étages bâtie sur GPT-5.6 Luna — il lit tout et décide ce qui est routinier, un modèle plus cher ne voit que le reste — est le levier de coût unique le plus efficace sur une charge conversationnelle. Et elle fonctionne précisément parce que l'étage bon marché n'est pas un modèle faible mais un palier plus petit de la même famille, avec les mêmes limites et la même interface. Même clé, même endpoint, une chaîne de modèle d'écart : l'escalade est un champ de votre requête, pas une seconde intégration.

Voix, autocomplétion, modération en direct, tout ce qu'un humain attend : le conseil d'OpenAI est d'essayer d'abord low puis de passer à none si nécessaire. GPT-5.6 Luna est le palier où ce conseil coûte le moins cher à suivre, et où la vitesse est de toute façon notée Fast. Gardez le prompt court, bornez la sortie, et traitez l'effort comme le bouton que l'on tourne avant d'aller chercher un autre fournisseur — le chemin rapide et le chemin profond de la famille sont la même API.
Basé sur les crédits — 1 crédit = 0,001 USD. Tu ne paies que les générations réussies.
Un prompt de 1K tokens avec une réponse de 1K tokens au palier le moins cher.
| Modèle | Catégorie | Prix |
|---|---|---|
| Facturation au token | Entrée | $0.16 1M tokens |
| Sortie | $0.96 1M tokens | |
| Contexte long · prompts au-delà de 272K tokens | Entrée | $0.32 1M tokens |
| Sortie | $1.44 1M tokens |
OpenAI publie un tarif par million de tokens pour l'entrée et la sortie de GPT-5.6 Luna. Sur reAPI, GPT-5.6 Luna passe sous les deux, et les tarifs de cette page sont mis à jour en direct. Aucun abonnement en dessous, aucun engagement minimum, paiement à l'usage depuis votre solde reAPI. Les chiffres exacts figurent dans le tableau tarifaire de cette page.
GPT-5.6 Luna est servi depuis un endpoint `/api/v1/chat/completions` standard. Si votre code parle déjà ce format, adopter GPT-5.6 Luna se résume à une base URL, une clé et une chaîne de modèle — les mêmes SDK fonctionnent dès que la base URL pointe vers reapi.ai. Pas de changement de SDK, pas de client sur mesure.
La clé reAPI qui appelle GPT-5.6 Luna appelle aussi ses frères plus grands, les familles Claude et Gemini, et les paliers à poids ouverts. C'est ce qui rend le routage par palier praticable : la cible d'escalade est une chaîne de modèle, pas une seconde relation fournisseur avec sa facture et ses identifiants.
C'est la comparaison qui décide réellement d'une route, et elle est exceptionnellement nette parce que GPT-5.6 Luna et GPT-5.6 Terra partagent presque tout : même fenêtre de contexte, même plafond de sortie, même échelle d'effort, mêmes outils, même coupure des connaissances, même endpoint. Ce qui diffère, c'est la marge de raisonnement qu'OpenAI attribue à chacun, la lignée dont ils descendent, et le prix. Lisez les lignes ci-dessous ainsi : cette route a-t-elle besoin de jugement, ou de débit ?
La comparaison reflète le comportement documenté par OpenAI sur ses propres pages de modèles au moment de la rédaction. Les tarifs sont décrits en termes de rapports et non de montants ; les chiffres réels pour GPT-5.6 Luna figurent dans le tableau tarifaire ci-dessus.
Connectez-vous à reAPI et créez une clé sous Clés API. Cette unique clé atteint GPT-5.6 Luna et tous les autres modèles de la plateforme, facturés depuis un seul solde.
OuvrirMettez votre base URL sur l'API de reapi.ai et votre clé sur celle que vous venez de créer. Tout client qui parle déjà OpenAI Chat Completions fonctionne sans modification — aucun changement de SDK n'est nécessaire pour atteindre GPT-5.6 Luna.
OuvrirMettez le champ model sur `gpt-5.6-luna` — avec les points — et postez vos messages. Sur ce palier, réglez l'effort de raisonnement délibérément : la valeur par défaut de la famille est medium, et sur des routes à fort volume c'est none ou low que vous voulez réellement.
Ouvrircurl https://reapi.ai/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-luna",
"messages": [
{ "role": "user", "content": "Hello" }
],
"reasoning_effort": "low",
"stream": true
}'Rejet synchrone avec le champ fautif nommé. Vérifiez enums, plages et champs URL — rien n'est facturé.
401 : clé Bearer absente ou invalide ; 402 : la réserve dépasse votre solde. Gérez clés et crédits dans la console.
Le matériel de référence et les sorties passent une modération automatique. Les tâches rejetées échouent avec une erreur claire et un remboursement intégral.
Une tâche en état d'échec n'est jamais facturée — la réserve est remboursée automatiquement. Conservez l'ID et réessayez.
Questions courantes sur ce modèle.
Explorez d’autres modèles de la même catégorie.

OpenAI
À partir de $1.00 par 1M de tokens

OpenAI
À partir de $1.60 par 1M de tokens

OpenAI
À partir de $3.20 par 1M de tokens

OpenAI
À partir de $8.00 par 1M de tokens
Essaie-le dans le playground ou récupère une clé API pour intégrer dès maintenant.