
OpenAI
GPT-5.4
Ab $1.00 pro 1M Token
GPT-5.6 Luna ist OpenAIs kostensensitive Stufe der GPT-5.6-Familie, und interessant ist, was sie nicht aufgibt: GPT-5.6 Luna trägt dasselbe Kontextfenster von 1.050.000 Tokens, denselben maximalen Output von 128.000 Tokens und dieselbe sechsstufige Reasoning-Skala wie das Spitzenmodell. Was sich ändert, ist der Preis und die Denktiefe, die man sinnvollerweise verlangt. Auf reAPI liegt GPT-5.6 Luna bei Input und Output jeweils 20% unter OpenAIs veröffentlichter Rate.
gpt-5.6-lunaChat-Modelle laufen im api.reapi.ai-Gateway, das eine eigene Konsole und einen eigenen Key hat. Öffne die Konsole, um GPT-5.6 Luna über die OpenAI-kompatible Chat-Completions-Schnittstelle auszuführen.
Echte Workflows und produktionsreife Use Cases, die du mit diesem Modell bauen und ausliefern kannst.

Das ist die Arbeit, die OpenAI für die niedrigste Effort-Stufe ausdrücklich nennt: schnelles Auffinden von Informationen und Klassifikation, wo Reasoning nur Latenz beiträgt und sonst nichts. Effort aus, Ausgabe per Schema gebunden — und GPT-5.6 Luna wird zum Bauteil statt zum Orakel: derselbe Prompt über eine Million Zeilen, zu einer Rate, bei der die Rechnung noch aufgeht. Bemerkenswert ist, dass der Wechsel auf diese Stufe die Eingaben nicht verkleinert: GPT-5.6 Luna liest dasselbe Fenster von 1.050.000 Tokens wie die Spitzenstufe, ein langes Dokument zwingt dich also nicht die Preisleiter hinauf, nur damit es hineinpasst.
API-Dokumentation lesen
Der Großteil des Produktionsverkehrs ist nicht schwer. Eine zweistufige Route auf Basis von GPT-5.6 Luna — es liest alles und entscheidet, was Routine ist, ein teureres Modell sieht nur den Rest — ist der wirksamste einzelne Kostenhebel auf einer Chat-Last. Und sie funktioniert genau deshalb, weil die günstige Stufe hier kein schwaches Modell ist, sondern eine kleinere Stufe derselben Familie mit denselben Grenzwerten und derselben Schnittstelle. Gleicher Key, gleicher Endpunkt, ein Model-String Unterschied: Eskalation ist ein Feld in deinem Request, keine zweite Integration.

Sprache, Autovervollständigung, Live-Moderation, alles, worauf ein Mensch wartet: OpenAIs eigener Rat dafür ist, zuerst low zu versuchen und bei Bedarf auf none zu gehen. GPT-5.6 Luna ist die Stufe, auf der dieser Rat am günstigsten umzusetzen ist, und die Geschwindigkeitsbewertung ist ohnehin Fast. Halte den Prompt kurz, begrenze den Output und behandle Effort als den Regler, den du drehst, bevor du dich nach einem anderen Anbieter umsiehst — der schnelle und der tiefe Pfad der Familie sind dieselbe API.
Credit-basiert — 1 Credit = 0,001 USD. Du zahlst nur für erfolgreich abgeschlossene Generierungen.
| Kategorie | Einheit | Preis |
|---|---|---|
| Token-Abrechnung | ||
| Input | 1M tokens | $0.8 |
| Output | 1M tokens | $4.8 |
OpenAI veröffentlicht für Input und Output von GPT-5.6 Luna eine Rate pro Million Tokens. Auf reAPI liegt GPT-5.6 Luna bei beidem 20% darunter — derselbe Abschlag auf jeder Dimension, dein bestehendes Kostenmodell skaliert also mit einer einzigen Zahl herunter. Kein Abo darunter, keine Mindestabnahme, nutzungsbasiert in USD gegen dein Gateway-Guthaben. Die genauen Zahlen stehen in der Preistabelle auf dieser Seite.
GPT-5.6 Luna wird über einen standardmäßigen `/v1/chat/completions`-Endpunkt bereitgestellt. Wenn dein Code diese Form schon spricht, ist die Umstellung auf GPT-5.6 Luna eine Base URL, ein Key und ein Model-String — dieselben SDKs funktionieren, sobald die Base URL auf das Gateway zeigt. Kein SDK-Tausch, kein eigener Client.
Derselbe api.reapi.ai-Key, der GPT-5.6 Luna aufruft, ruft auch die größeren Geschwister, die Claude- und Gemini-Familien und die Open-Weight-Stufen auf. Genau das macht gestaffeltes Routing praktikabel: Das Eskalationsziel ist ein Model-String und keine zweite Anbieterbeziehung mit eigener Rechnung und eigenen Zugangsdaten.
Das ist der Vergleich, der tatsächlich eine Route entscheidet, und er ist ungewöhnlich klar, weil GPT-5.6 Luna und GPT-5.6 Terra fast alles teilen: dasselbe Kontextfenster, dieselbe Output-Grenze, dieselbe Effort-Leiter, dieselben Tools, denselben Wissensstand, denselben Endpunkt. Unterschiedlich sind der Reasoning-Spielraum, den OpenAI jedem zuschreibt, die Linie, von der sie abstammen, und der Preis. Lies die Zeilen unten so: Braucht diese Route Urteilsvermögen oder Durchsatz?
Der Vergleich spiegelt das Verhalten, das OpenAI zum Zeitpunkt der Erstellung auf den eigenen Modellseiten dokumentiert. Raten werden als Verhältnisse und nicht als Beträge beschrieben; die aktuellen Zahlen für GPT-5.6 Luna stehen in der Preistabelle oben.
Registriere dich auf api.reapi.ai, öffne die Konsole und erzeuge einen API-Key. Dieser eine Key erreicht GPT-5.6 Luna und jedes andere Modell im Gateway, abgerechnet über ein einziges Guthaben.
ÖffnenSetze deine Base URL auf api.reapi.ai und deinen Key auf den gerade erzeugten. Jeder Client, der schon OpenAI Chat Completions spricht, läuft unverändert — für GPT-5.6 Luna ist kein SDK-Tausch nötig.
ÖffnenSetze das Model-Feld auf `gpt-5.6-luna` — mit den Punkten — und poste deine Messages. Setz den Reasoning-Effort auf dieser Stufe bewusst: Der Familienstandard ist medium, auf Volumen-Routen willst du meist none oder low.
ÖffnenHäufige Fragen zu diesem Modell.
Entdecke weitere Modelle derselben Kategorie.

OpenAI
Ab $1.00 pro 1M Token

OpenAI
Ab $2.00 pro 1M Tokens

OpenAI
Ab $4.00 pro 1M Tokens

OpenAI
Ab $4.00 pro 1M Token
Probiere es im Playground aus oder hol dir einen API-Key, um direkt loszulegen.