
OpenAI
GPT-5.4
Ab $1.00 pro 1M Token
Gemini 3.6 Flash ist Googles neuestes Stable-Modell der Gemini-3-Reihe und darauf ausgelegt, Geschwindigkeit und Intelligenz über agentische und multimodale Aufgaben hinweg auszubalancieren. Gemini 3.6 Flash liest Text, Bilder, Video, Audio und PDF in ein Kontextfenster von 1.048.576 Token und gibt bis zu 65.536 Token zurück, mit Thinking, Function Calling und Google-Search-Grounding. Auf reAPI läuft Gemini 3.6 Flash bei Eingabe und Ausgabe 20 % unter Googles veröffentlichtem Standard-Tarif.
gemini-3.6-flashChat-Modelle laufen im api.reapi.ai-Gateway, das eine eigene Konsole und einen eigenen Key hat. Öffne die Konsole, um Gemini 3.6 Flash über die OpenAI-kompatible Chat-Completions-Schnittstelle auszuführen.
Echte Workflows und produktionsreife Use Cases, die du mit diesem Modell bauen und ausliefern kannst.

PDF ist für Gemini 3.6 Flash eine vollwertige Eingabe und kein Vorverarbeitungsschritt, den du selbst betreiben musst. Zusammen mit dem Kontextfenster von 1.048.576 Token heißt das: ein Vertragspaket, ein Recherchebündel oder ein Jahr an Berichten geht in einen Aufruf und kommt querverwiesen zurück. Gemini 3.6 Flash nimmt in derselben Nachricht auch Bilder, Video und Audio an, sodass eine Dokumentprüfung die zugehörigen Screenshots und Aufzeichnungen einschließen kann. Der praktische Gewinn: Du pflegst keine Retrieval-Schicht mehr, deren einzige Aufgabe das Umgehen eines kleinen Kontextfensters war.
API-Dokumentation lesen
Gemini 3.6 Flash unterstützt Function Calling, Code-Ausführung und File Search; Computer Use führt Google als Preview-Unterstützung. Search-Grounding und Grounding mit Google Maps sind beide unterstützt, sodass Gemini 3.6 Flash aus aktuellen Quellen antworten kann und nicht nur aus Trainingsdaten. Mit URL Context lässt sich direkt auf eine Seite verweisen. Thinking ist unterstützt und trägt mehrstufige Pläne über Tool-Aufrufe hinweg. Diese Kombination macht Gemini 3.6 Flash als Reasoning-Kern eines Agenten nutzbar, nicht nur als Textgenerator.

Bei den meisten generativen Workloads dominieren Ausgabe-Token die Kosten, und Thinking-Token zählen als Ausgabe. Gemini 3.6 Flash hat bei gleichem Eingabetarif einen niedrigeren veröffentlichten Ausgabetarif als Gemini 3.5 Flash, und auf reAPI liegen beide Dimensionen 20 % unter Googles veröffentlichtem Standard-Tarif. Für Zusammenfassungs-Flotten, Klassifikations-Pipelines und Agenten-Loops im Dauerbetrieb ist das die Zahl, die die Monatsrechnung bewegt. Gemini 3.6 Flash behält dabei dasselbe Fenster von einer Million Token — günstiger heißt hier nicht kleiner.
Credit-basiert — 1 Credit = 0,001 USD. Du zahlst nur für erfolgreich abgeschlossene Generierungen.
| Kategorie | Einheit | Preis |
|---|---|---|
| Token-Abrechnung | ||
| Eingabe | 1M tokens | $1.2 |
| Ausgabe | 1M tokens | $6 |
Google veröffentlicht für Gemini 3.6 Flash einen Standard-Tarif für Eingabe und Ausgabe. Auf reAPI wird Gemini 3.6 Flash mit 80 % davon abgerechnet — pauschal 20 % Rabatt auf Eingabe und Ausgabe, ohne Abonnement darunter und ohne Mindestabnahme. Nutzungsbasiert in USD gegen dein Gateway-Guthaben.
Gemini 3.6 Flash wird über einen OpenAI-kompatiblen `/v1/chat/completions`-Endpunkt bereitgestellt. Wenn dein Code diese Form schon spricht, ist die Umstellung auf Gemini 3.6 Flash eine Basis-URL, ein Key und ein Model-String. Das Gateway bietet für dieses Modell zusätzlich einen nativen Gemini-Endpunkttyp, falls du Googles eigenes Anfrageformat bevorzugst.
Derselbe api.reapi.ai-Key, der Gemini 3.6 Flash aufruft, erreicht auch die GPT- und Claude-Familien. Modelle für einen Qualitätsvergleich zu wechseln oder bei Störungen eines Anbieters auszuweichen ist ein Model-String — und nicht eine zweite Integration, eine zweite Rechnung und ein zweiter Satz Zugangsdaten.
Die ehrliche Fassung dieses Vergleichs ist kurz: In jeder von Google veröffentlichten Dimension haben Gemini 3.6 Flash und Gemini 3.5 Flash dieselbe Oberfläche. Gleiche Grenzen, gleiche Eingaben, gleiche Fähigkeitsliste, gleiche Verbrauchsoptionen. Gemini 3.6 Flash ist eine Preis- und Positionierungsänderung, kein Fähigkeitssprung — wer zwischen beiden wählt, entscheidet also anhand des Ausgabetarifs und der Aktualität.
Der Vergleich spiegelt das Verhalten wider, das zum Zeitpunkt der Erstellung auf Googles eigenen Modell- und Preisseiten dokumentiert war. Tarife werden als Verhältnis und nicht als Betrag beschrieben; die aktuellen Zahlen für Gemini 3.6 Flash stehen in der Preistabelle oben.
Registriere dich auf api.reapi.ai, öffne die Konsole und erzeuge einen API-Key. Dieser eine Key erreicht Gemini 3.6 Flash und jedes andere Modell im Gateway, abgerechnet aus einem einzigen Guthaben.
ÖffnenSetze die Basis-URL auf api.reapi.ai und den Key auf den gerade erzeugten. Jeder Client, der OpenAI Chat Completions spricht, funktioniert unverändert — für Gemini 3.6 Flash ist kein SDK-Wechsel nötig.
ÖffnenSetze das Model-Feld auf `gemini-3.6-flash` und sende deine Messages. Aktiviere Streaming für alles Interaktive und erhöhe Max Tokens, wenn Gemini 3.6 Flash mehr von seiner Ausgabegrenze von 65.536 Token nutzen soll.
ÖffnenHäufige Fragen zu diesem Modell.
Entdecke weitere Modelle derselben Kategorie.

OpenAI
Ab $1.00 pro 1M Token

DeepSeek
Ab $0.140 pro 1M Tokens

MiniMax
Ab $0.600 pro 1M Token

Anthropic
Ab $2.00 pro 1M Tokens
Probiere es im Playground aus oder hol dir einen API-Key, um direkt loszulegen.