
GPT-6 Sol Preise: API-Preis, Token-Kosten und Cache-Tarife
GPT-6 Sol Preise pro Million Tokens: Input, Output, Cache-Reads und -Writes, die 272K-Long-Context-Regel, Batch, Flex und Fast mode, mit durchgerechneten Kostenbeispielen.
Die Preise für GPT-6 Sol beginnen in der OpenAI-API bei $2 pro Million Input-Tokens und $10 pro Million Output-Tokens, für Prompts mit bis zu 272K Input-Tokens[1]. Diese beiden Zahlen sind nur ein Teil der Rechnung. OpenAI berechnet gecachten Input und Cache-Writes separat, verdoppelt den Input-Tarif, sobald ein Prompt 272K Tokens überschreitet, und bietet Batch, Flex und Fast mode zu unterschiedlichen Multiplikatoren an[2].
Dieser Artikel listet jeden Tarif, den OpenAI für GPT-6 Sol mit Stand 7. Oktober 2026 veröffentlicht, rechnet vier Kostenbeispiele mit offengelegten Annahmen durch und beantwortet die Frage, die wir oft zusammen mit dem Thema gesucht sehen: ob der aktuelle Preis ein Aktionspreis ist.
TL;DR
- Standardtarife: $2 Input, $0.20 gecachter Input, $2.50 Cache-Write und $10 Output pro Million Tokens, für Prompts bis 272K Input-Tokens[1].
- Lange Prompts: Über 272K Input-Tokens wechselt der gesamte Request zu $4 Input, $0.40 gecacht, $5 Cache-Write und $15 Output[1][2].
- Reasoning-Tokens werden als Output abgerechnet. Das gewählte Effort-Level verändert die Output-Menge und damit die Kosten[3].
- Verarbeitungsstufen: Batch und Flex kosten 50% von Standard, Fast mode kostet 2x, und regionale Verarbeitung schlägt 10% auf[2].
- Keine Aktion gefunden: Der Aktionspreis auf den OpenAI-Seiten gehört zu GPT-5.6 Sol, nicht zu GPT-6 Sol[1][4].
- Bei reAPI: Abrechnung pro Token auf denselben vier Dimensionen, die Tarife stehen auf der GPT-6 Sol Modellseite.
GPT-6 Sol Preise pro Million Tokens
OpenAIs Preisseite teilt jeden Tarif in eine Spalte für kurzen Kontext (bis 272K Input-Tokens) und eine für langen Kontext (über 272K)[1]:
| GPT-6 Sol, Standard, pro 1M Tokens | Bis 272K Input | Über 272K Input |
|---|---|---|
| Input | $2.00 | $4.00 |
| Gecachter Input | $0.20 | $0.40 |
| Cache-Writes | $2.50 | $5.00 |
| Output | $10.00 | $15.00 |
Die Modellseite erklärt die Verhältnisse. Gecachter Input kostet 10% des ungecachten Input-Tarifs, Cache-Writes das 1.25-Fache davon, und Prompts über 272K werden „mit dem 2-Fachen der Input- und Cache-Tarife und dem 1.5-Fachen des Outputs für den gesamten Request berechnet"[2]. Entscheidend sind die Worte „für den gesamten Request". Wer die Schwelle überschreitet, lässt jeden Token des Requests neu bepreisen, nicht nur die Tokens oberhalb von 272K.
Zwei Grenzen bestimmen, was ein einzelner Request kosten kann. GPT-6 Sol akzeptiert bis zu 922,000 Input-Tokens und liefert bis zu 128,000 Output-Tokens, innerhalb eines Kontextfensters von 1,050,000 Tokens[2].
Was eine GPT-6 Sol Rechnung verändert
Reasoning-Tokens. GPT-6 Sol ist ein Reasoning-Modell. Laut OpenAIs Reasoning-Leitfaden sind Reasoning-Tokens über die API nicht sichtbar, werden aber „als Output-Tokens abgerechnet"[3]. Die Effort-Einstellung reicht von none bis max, mit medium als Standard[2]. Ein Request ohne gesetzten Effort bezahlt also trotzdem einen Reasoning-Durchlauf zum Output-Tarif von $10.
Caching. Für GPT-5.6 und neuere Modelle berechnet OpenAI einen Cache-Write mit dem 1.25-Fachen des Input-Tarifs und einen Cache-Read mit dem 0.1-Fachen. Ein gecachtes Präfix bleibt mindestens 30 Minuten nach seinem letzten Write oder seiner letzten Wiederverwendung verfügbar, und das kleinste cachebare Präfix umfasst 1,024 Input-Tokens[5]. Cache-Writes ersetzen für diese Tokens den normalen Input-Tarif, statt hinzuzukommen[5]. In der Praxis kostet ein Präfix, das einmal geschrieben und einmal wiederverwendet wird, das 1.35-Fache seines ungecachten Preises, gegenüber dem 2-Fachen ohne Caching[5].
Verarbeitungsstufe. Dieselben Tokens kosten unterschiedlich viel, je nachdem, wie man sie sendet[1]:
| GPT-6 Sol, pro 1M Tokens, bis 272K | Input | Gecachter Input | Cache-Writes | Output |
|---|---|---|---|---|
| Standard | $2.00 | $0.20 | $2.50 | $10.00 |
| Batch | $1.00 | $0.10 | $1.25 | $5.00 |
| Flex | $1.00 | $0.10 | $1.25 | $5.00 |
| Fast mode | $4.00 | $0.40 | $5.00 | $20.00 |
Flex nutzt die Batch-Tarife, im Gegenzug für langsamere Antworten und gelegentlich nicht verfügbare Ressourcen, und OpenAI bezeichnet es als Beta[6]. Regionale Verarbeitung (Data Residency) schlägt dort, wo sie verfügbar ist, 10% auf, und Fast mode ist für GPT-6 Sol nicht mit EU-Data-Residency verfügbar[2][7].
GPT-6 Sol Kostenbeispiele
Alle vier Beispiele verwenden die obigen Listenpreise von OpenAI. Es sind Illustrationen mit offengelegten Annahmen, keine Messungen echten Traffics. Die Token-Mengen Ihrer Prompts werden abweichen, und die Output-Mengen enthalten Reasoning-Tokens.
Beispiel A: ein Chat-Request. 2,000 Input-Tokens und 800 Output-Tokens, Standard, kein Cache. 2,000 × $2 / 1M = $0.004 für Input und 800 × $10 / 1M = $0.008 für Output, also $0.012 pro Request oder $12 pro 1,000 Requests.
Beispiel B: ein gemeinsames Präfix mit Caching. 40 Requests verwenden denselben Block aus 50,000 Tokens mit Anweisungen und Referenzmaterial wieder, jeder fügt 2,000 neue Input-Tokens hinzu und erhält 1,000 Output-Tokens zurück. Angenommen wird ein expliziter Cache-Breakpoint nach dem gemeinsamen Block, und alle 40 Requests liegen innerhalb der Cache-Lebensdauer. Der neue Input nach dem Breakpoint wird zum normalen Input-Tarif ohne Write-Gebühr abgerechnet[5].
| Posten | Rechnung | Kosten |
|---|---|---|
| Erster Cache-Write | 50,000 × $2.50 / 1M | $0.125 |
| 39 Cache-Reads | 39 × 50,000 × $0.20 / 1M | $0.390 |
| Neuer Input | 40 × 2,000 × $2 / 1M | $0.160 |
| Output | 40 × 1,000 × $10 / 1M | $0.400 |
| Summe mit Caching | $1.075 | |
| Summe ohne Caching | 40 × 52,000 × $2 / 1M + $0.40 | $4.56 |
In diesem Szenario senkt Caching die Rechnung um etwa drei Viertel, weil der Großteil jedes Prompts aus dem wiederholten Block besteht.
Beispiel C: 272K überschreiten. Ein Request mit 300,000 Input-Tokens und 5,000 Output-Tokens wechselt zu den Long-Context-Tarifen: 300,000 × $4 / 1M = $1.20, plus 5,000 × $15 / 1M = $0.075, macht $1.275. Kürzt man denselben Request auf 270,000 Input-Tokens, kostet er 270,000 × $2 / 1M = $0.54 plus 5,000 × $10 / 1M = $0.05, also $0.59. Wer 10% des Inputs streicht, senkt die Kosten um mehr als die Hälfte. Prüfen Sie daher die Prompt-Länge, bevor Sie ganze Repositories oder Dokumentensammlungen senden.
Beispiel D: derselbe Job auf jeder Stufe. Beispiel A, 10,000-mal ausgeführt, kostet $120 auf Standard, $60 auf Batch oder Flex und $240 im Fast mode (2,000 × $4 / 1M + 800 × $20 / 1M = $0.024 pro Request).
Um Ihre eigene Last abzuschätzen, multiplizieren Sie jeden Token-Typ mit seinem Tarif: ungecachter Input × Input-Tarif, Cache-Reads × Cache-Tarif, Cache-Writes × Write-Tarif und Output (inklusive Reasoning) × Output-Tarif. Verwenden Sie die Long-Context-Spalte, sobald ein einzelner Request 272K Input-Tokens überschreitet.
Gibt es für GPT-6 Sol einen Aktionspreis?
Wir haben keinen Hinweis darauf gefunden. OpenAIs Preisseite enthält einen einzigen Aktionshinweis: „Der Aktionspreis von GPT-5.6 Sol gilt mindestens bis zum 21. November 2026"[1]. Die GPT-6 Sol Modellseite, der Changelog-Eintrag vom 22. September, der GPT-6 Sol zu $2 Input und $10 Output ankündigte, und der Launch-Post enthalten für GPT-6 Sol weder einen Aktionsvermerk noch ein Enddatum[2][4][8]. Der Launch-Post verwendet „promotional" nur, um zu beschreiben, womit GPT-6 Sol verglichen wurde: Die Preise von Sol und Luna sanken „um 50% gegenüber ihrem GPT‑5.6-Aktionspreis"[8].
Sollte OpenAI den Preis von GPT-6 Sol später zeitlich begrenzen, würde das sehr wahrscheinlich auf derselben Preisseite und im selben Changelog erscheinen, die hier zitiert sind.
GPT-6 Sol Preise im Vergleich mit anderen OpenAI-Modellen
Standardtarife für kurzen Kontext pro Million Tokens laut OpenAIs Preisseite[1]:
| Modell | Input | Gecachter Input | Cache-Writes | Output |
|---|---|---|---|---|
| GPT-6 Astra | $10.00 | $1.00 | $12.50 | $50.00 |
| GPT-6.1 Sol | $2.00 | $0.10 | $2.50 | $10.00 |
| GPT-6 Sol | $2.00 | $0.20 | $2.50 | $10.00 |
| GPT-6 Luna | $0.10 | $0.01 | $0.125 | $0.50 |
| GPT-5.6 Sol | $4.00 | $0.40 | $5.00 | $20.00 |
GPT-6.1 Sol, erschienen am 29. September 2026, hat dieselben Input-, Output- und Cache-Write-Tarife wie GPT-6 Sol, aber nur den halben Tarif für gecachten Input: 5% des Inputs statt 10%[4][5]. Bei cachelastigen Agent-Schleifen summiert sich dieser Unterschied, allerdings streicht GPT-6.1 Sol auch den Effort none und Tool-Calling in Chat Completions[9]. Unser Vergleich GPT-6 Sol vs 5.6 Sol behandelt die Migrationsseite.
GPT-6 Sol Preise bei reAPI
reAPI stellt GPT-6 Sol über seinen Chat-Completions-Endpunkt mit der Modell-ID gpt-6-sol bereit, abgerechnet pro Token aus Ihrem reAPI-Guthaben. Die Abrechnungsdimensionen folgen denen von OpenAI: Input, Output, Cache-Read und Cache-Write haben jeweils einen eigenen Tarif, Reasoning-Tokens werden als Output abgerechnet, und Prompts über 272K Input-Tokens bepreisen den gesamten Request zu den Long-Context-Tarifen neu[10]. Laut reAPI-Dokumentation liegt jeder Tarif unter OpenAIs veröffentlichtem Tarif pro Token[10]. Aktuelle Zahlen und ein Kostenrechner stehen auf der GPT-6 Sol Modellseite.
FAQ
GPT-6 Sol: Wie lange gilt der Aktionspreis?
Wir haben auf OpenAIs Preisseite, der Modellseite, im Changelog und im Launch-Post keinen Aktionszeitraum für GPT-6 Sol gefunden[1][2][4][8]. Die von OpenAI dokumentierte Aktion betrifft GPT-5.6 Sol, zu $4 Input und $20 Output, verfügbar mindestens bis zum 21. November 2026[1].
Wie viel kostet Chat GPT 6?
In der API kostet GPT-6 Sol $2 pro Million Input-Tokens und $10 pro Million Output-Tokens bei Standard-Verarbeitung. GPT-6 Astra kostet $10 und $50, GPT-6 Luna $0.10 und $0.50[1]. In ChatGPT ist GPT-6 Sol in ChatGPT Work und Codex in den Plänen Plus, Pro, Business, Enterprise und Edu verfügbar[8]; die Planpreise liegen außerhalb des Umfangs dieses Artikels.
GPT-6 Sol Fast-Preise
Fast mode kostet für GPT-6 Sol das 2-Fache von Standard: $4 Input, $0.40 gecachter Input, $5 Cache-Write und $20 Output pro Million Tokens bis 272K, darüber $8, $0.80, $10 und $30[1][2].
GPT-6 Sol Kosten pro Token
Pro Token kostet GPT-6 Sol zu Standard-Tarifen für kurzen Kontext $0.000002 pro Input-Token und $0.00001 pro Output-Token, also $2 und $10 pro Million[1]. Gecachte Input-Tokens kosten ein Zehntel des Input-Tarifs[2].
GPT-6 Sol Preisrechner
Multiplizieren Sie jeden Token-Typ mit seinem Tarif und addieren Sie: Input × $2, gecachter Input × $0.20, Cache-Writes × $2.50 und Output × $10, jeweils pro Million Tokens. Wechseln Sie zu $4, $0.40, $5 und $15, sobald ein Request 272K Input-Tokens überschreitet[1]. Die GPT-6 Sol Modellseite hat einen Rechner für die reAPI-Tarife.
GPT 5.6 Sol vs 6 Sol Preis
GPT-6 Sol kostet in jeder Zeile die Hälfte von GPT-5.6 Sol: $2 gegenüber $4 für Input, $10 gegenüber $20 für Output, $0.20 gegenüber $0.40 für gecachten Input und $2.50 gegenüber $5 für Cache-Writes[1]. Die $4 und $20 von GPT-5.6 Sol sind ein Aktionspreis, der mindestens bis zum 21. November 2026 gilt[1].
Wie viel kostet eine GPT API?
Das hängt vom Modell ab. Auf OpenAIs aktueller Preisseite reichen die Standard-Input-Tarife pro Million Tokens unter den GPT-6-Modellen von $0.10 für GPT-6 Luna bis $10 für GPT-6 Astra, wobei Output bei jedem davon teurer ist als Input[1].
Budgetplanung für GPT-6 Sol
Bei den meisten Workloads ist der erste Hebel die Output-Menge, denn Output kostet fünfmal so viel wie Input und enthält das Reasoning. Wählen Sie den niedrigsten Effort, der Ihre Qualitätsprüfungen besteht. Der zweite Hebel ist das Caching jedes Blocks aus Anweisungen oder Dokumenten, den Sie wiederholt senden; in Beispiel B senkte das die Kosten um etwa drei Viertel. Der dritte ist, pro Request unter 272K Input-Tokens zu bleiben. Wenn Ergebnisse warten können, halbiert Batch die Rechnung. Der Listenpreis von GPT-6 Sol bei OpenAI beträgt $2 Input und $10 Output pro Million Tokens, ohne veröffentlichtes Aktionsende, und die aktuellen reAPI-Tarife pro Token stehen auf der GPT-6 Sol Modellseite.
References
- OpenAI. API pricing. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/pricing
- OpenAI. GPT-6 Sol model page. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/models/gpt-6-sol
- OpenAI. Reasoning models. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/guides/reasoning
- OpenAI. API changelog. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/changelog
- OpenAI. Prompt caching. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/guides/prompt-caching
- OpenAI. Flex processing. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/guides/flex-processing
- OpenAI. Fast mode. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/guides/fast-mode
- OpenAI. Introducing GPT-6 Sol and Luna. Abgerufen im Oktober 2026 von openai.com/index/introducing-gpt-6-sol-and-luna
- OpenAI. GPT-6.1 Sol model page. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/models/gpt-6.1-sol
- reAPI. GPT-6 Sol API docs. Abgerufen im Oktober 2026 von reapi.ai/docs/gpt-6-sol
Autor

Kategorien
Weitere Beiträge

Mit Python Videos hochskalieren: Batch-Pipeline und Kosten
Batch-Video-Hochskalierung mit Python: 80-zeilige Pipeline, Rate-Limit-Budgetierung, Kosten ab $0.002/s und sichere Wiederaufnahme nach Absturz.


Die beste API-Plattform für KI-Designtools und Marketing-Tools
Vier API-Plattformen im direkten Vergleich: Anfragearchitektur, echte Preise und die Einsatzszenarien jeder Lösung. Welche passt zu deinem Projekt?


KI-Musikvideo-API: Vollständige Videos aus Song und Bildern
Vollständiges Musikvideo aus einem Song und bis zu sieben Referenzbildern – API-Beispiele, Untertiteloptionen und genaue Kostentabellen für jede Auflösung.
