Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references

GPT-5.6 Luna — contexte 1,05M sur le palier volume

GPT-5.6 Luna est le palier économique d'OpenAI dans la famille GPT-5.6, et l'intéressant est ce qu'il ne sacrifie pas : GPT-5.6 Luna dispose de la même fenêtre de contexte de 1 050 000 tokens, de la même sortie maximale de 128 000 tokens et du même cadran de raisonnement à six crans que son frère de pointe. Ce qui change, c'est le prix et la profondeur de réflexion qu'il est raisonnable de lui demander. Sur reAPI, GPT-5.6 Luna est facturé sous le tarif publié par OpenAI, en entrée comme en sortie.

Points clés
Niveaux d'effort de raisonnement · outils & mode JSON
Idéal pour
Réponses rapides, tâches quotidiennes
Entrée
Messages de chat (OpenAI-compatible)
Sortie
Texte, streaming optionnel
GPT-5.6 Luna

Interroger GPT-5.6 Luna

Commencez avec le texte du champ de saisie ou choisissez un exemple.

Entrée pour envoyer · Maj+Entrée pour une nouvelle ligne

Qu'est-ce que l'API GPT-5.6 Luna ?

GPT-5.6 Luna est le palier économique de la famille GPT-5.6, servi sur reAPI par un endpoint /api/v1/chat/completions compatible OpenAI. Il n'abandonne aucune des limites de la famille : la même fenêtre de contexte de 1 050 000 tokens, la même sortie maximale de 128 000 tokens et les mêmes six crans d'effort de raisonnement, de none à max, avec medium par défaut, en entrée texte et image et en sortie texte. La facturation se fait par 1M de tokens, entrée et sortie tarifées séparément ; les tokens de raisonnement comptent comme de la sortie.

Ce que tu peux construire avec ce modèle

Des workflows réels et des cas d'usage en production que tu peux construire et déployer avec ce modèle.

GPT-5.6 Luna classant une file de documents avec le raisonnement coupé

Classification et extraction, tarifées pour la file entière

C'est le travail qu'OpenAI nomme pour le cran d'effort le plus bas : recherche rapide d'informations et classification, là où le raisonnement n'ajoute que de la latence. Coupez l'effort, contraignez la sortie par un schéma, et GPT-5.6 Luna devient un composant plutôt qu'un oracle : le même prompt sur un million de lignes, à un tarif où le calcul tient encore. Le point à remarquer est que descendre sur ce palier ne réduit pas vos entrées : GPT-5.6 Luna lit la même fenêtre de 1 050 000 tokens que le palier de pointe, un long document ne vous force donc pas à remonter l'échelle des prix juste pour tenir.

Lire la doc API
GPT-5.6 Luna triant les requêtes et n'escaladant que les difficiles

Le premier passage bon marché devant un modèle coûteux

L'essentiel du trafic de production n'est pas difficile. Une route en deux étages bâtie sur GPT-5.6 Luna — il lit tout et décide ce qui est routinier, un modèle plus cher ne voit que le reste — est le levier de coût unique le plus efficace sur une charge conversationnelle. Et elle fonctionne précisément parce que l'étage bon marché n'est pas un modèle faible mais un palier plus petit de la même famille, avec les mêmes limites et la même interface. Même clé, même endpoint, une chaîne de modèle d'écart : l'escalade est un champ de votre requête, pas une seconde intégration.

GPT-5.6 Luna répondant à une requête sensible à la latence sans passe de raisonnement

Les chemins critiques en latence où réfléchir est le mauvais outil

Voix, autocomplétion, modération en direct, tout ce qu'un humain attend : le conseil d'OpenAI est d'essayer d'abord low puis de passer à none si nécessaire. GPT-5.6 Luna est le palier où ce conseil coûte le moins cher à suivre, et où la vitesse est de toute façon notée Fast. Gardez le prompt court, bornez la sortie, et traitez l'effort comme le bouton que l'on tourne avant d'aller chercher un autre fournisseur — le chemin rapide et le chemin profond de la famille sont la même API.

Tarifs

Basé sur les crédits — 1 crédit = 0,001 USD. Tu ne paies que les générations réussies.

Coût du premier test
$0.00111.12 credits

Un prompt de 1K tokens avec une réponse de 1K tokens au palier le moins cher.

Guide de budget de test
Ajouter des crédits
$10
≈ 8928 tests
$50
≈ 44642 tests
$100
≈ 89285 tests
ModèleCatégoriePrix
Facturation au tokenEntrée
$0.16
1M tokens
Sortie
$0.96
1M tokens
Contexte long · prompts au-delà de 272K tokensEntrée
$0.32
1M tokens
Sortie
$1.44
1M tokens

Pourquoi reAPI

Sous le tarif publié

OpenAI publie un tarif par million de tokens pour l'entrée et la sortie de GPT-5.6 Luna. Sur reAPI, GPT-5.6 Luna passe sous les deux, et les tarifs de cette page sont mis à jour en direct. Aucun abonnement en dessous, aucun engagement minimum, paiement à l'usage depuis votre solde reAPI. Les chiffres exacts figurent dans le tableau tarifaire de cette page.

Compatible OpenAI, remplacement direct

GPT-5.6 Luna est servi depuis un endpoint `/api/v1/chat/completions` standard. Si votre code parle déjà ce format, adopter GPT-5.6 Luna se résume à une base URL, une clé et une chaîne de modèle — les mêmes SDK fonctionnent dès que la base URL pointe vers reapi.ai. Pas de changement de SDK, pas de client sur mesure.

Une clé pour toute l'échelle

La clé reAPI qui appelle GPT-5.6 Luna appelle aussi ses frères plus grands, les familles Claude et Gemini, et les paliers à poids ouverts. C'est ce qui rend le routage par palier praticable : la cible d'escalade est une chaîne de modèle, pas une seconde relation fournisseur avec sa facture et ses identifiants.

GPT-5.6 Luna vs GPT-5.6 Terra

C'est la comparaison qui décide réellement d'une route, et elle est exceptionnellement nette parce que GPT-5.6 Luna et GPT-5.6 Terra partagent presque tout : même fenêtre de contexte, même plafond de sortie, même échelle d'effort, mêmes outils, même coupure des connaissances, même endpoint. Ce qui diffère, c'est la marge de raisonnement qu'OpenAI attribue à chacun, la lignée dont ils descendent, et le prix. Lisez les lignes ci-dessous ainsi : cette route a-t-elle besoin de jugement, ou de débit ?

Capacité
GPT-5.6 Luna sur reAPI
GPT-5.6 Terra
Positionnement d'OpenAI
Optimisé pour les charges sensibles au coût et à fort volume
Équilibre intelligence et coût
Note de raisonnement
High — la note d'entrée de la famille
Higher — un cran au-dessus
Lignée de la génération précédente
Correspond au palier nano des familles GPT-5 antérieures
Correspond au palier mini
Tarif sur reAPI
Le plus bas des trois paliers — voir le tableau tarifaire ci-dessus
Plus élevé que Luna, plus bas que le palier de pointe
Limites de contexte et de sortie
Contexte de 1 050 000 tokens, sortie maximale de 128 000 tokens
Identiques — les limites ne changent pas d'un palier à l'autre
Échelle d'effort et outils
Les six crans, fonctions, recherche web, recherche de fichiers, usage de l'ordinateur
Identiques — la différence est de savoir quels crans méritent d'être payés

La comparaison reflète le comportement documenté par OpenAI sur ses propres pages de modèles au moment de la rédaction. Les tarifs sont décrits en termes de rapports et non de montants ; les chiffres réels pour GPT-5.6 Luna figurent dans le tableau tarifaire ci-dessus.

Mettre GPT-5.6 Luna en production en trois étapes

  1. step 01

    Créer une clé API reAPI

    Connectez-vous à reAPI et créez une clé sous Clés API. Cette unique clé atteint GPT-5.6 Luna et tous les autres modèles de la plateforme, facturés depuis un seul solde.

    Ouvrir
  2. step 02

    Pointer votre client vers reapi.ai

    Mettez votre base URL sur l'API de reapi.ai et votre clé sur celle que vous venez de créer. Tout client qui parle déjà OpenAI Chat Completions fonctionne sans modification — aucun changement de SDK n'est nécessaire pour atteindre GPT-5.6 Luna.

    Ouvrir
  3. step 03

    Envoyer `gpt-5.6-luna` comme modèle

    Mettez le champ model sur `gpt-5.6-luna` — avec les points — et postez vos messages. Sur ce palier, réglez l'effort de raisonnement délibérément : la valeur par défaut de la famille est medium, et sur des routes à fort volume c'est none ou low que vous voulez réellement.

    Ouvrir
docs/api/gpt-5-6-luna

Référence API

Code prêt à l'emploi et tableau complet des paramètres.

curl https://reapi.ai/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-luna",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "low",
    "stream": true
  }'

Échec de validation des paramètres

Rejet synchrone avec le champ fautif nommé. Vérifiez enums, plages et champs URL — rien n'est facturé.

Problème d'authentification ou de solde

401 : clé Bearer absente ou invalide ; 402 : la réserve dépasse votre solde. Gérez clés et crédits dans la console.

Contenu ou matériel rejeté

Le matériel de référence et les sorties passent une modération automatique. Les tâches rejetées échouent avec une erreur claire et un remboursement intégral.

Tâche échouée ou expirée

Une tâche en état d'échec n'est jamais facturée — la réserve est remboursée automatiquement. Conservez l'ID et réessayez.

Questions fréquentes

Questions courantes sur ce modèle.

GPT-5.6 Luna est facturé à l'usage au token depuis votre solde reAPI, avec des tarifs distincts en entrée et en sortie et sans abonnement. Les deux se situent sous le tarif par token publié par OpenAI. Les chiffres actuels figurent dans le tableau tarifaire de cette page.

start building

Prêt à déployer ?

Essaie-le dans le playground ou récupère une clé API pour intégrer dès maintenant.