
Mammouth AI Preise: Tarife, Limits und API-Zugang (2026)
Mammouth AI Preisgestaltung erklärt: Starter-, Standard-, Expert-Tarife, Quota-Reset nach drei Stunden, inklusive API-Credits und Dateigrößenlimits.
Mammouth AI bietet drei monatliche Chat-Tarife an, aber Währung und Steueranzeige hängen vom Standort ab. Bei einer US-Region-Überprüfung am 30. Juli 2026 erschienen Starter, Standard und Expert mit $12, $24 und $72 vor VAT; europäische Besucher konnten €12, €24 und €72 mit inklusive VAT sehen. Die Tarife sind nicht unbegrenzt: Kontingente erneuern sich vollständig nach drei Stunden, wobei Standard das Dreifache des Starter-Kontingents erhält und Expert das Zehnfache des Starter-Kontingents.[1][2]
Die API ist ein separater Zähler. Jedes Abonnement enthält einen kleinen monatlichen API-Gutschrift, aber Entwickler können Mammouth's OpenAI-kompatible API auch auf Basis von Pay-as-you-go ohne Chat-Abonnement finanzieren.[3] Diese Unterscheidung ist der Schlüssel zum Verständnis der Mammouth AI Preisgestaltung: Das Abonnement bezahlt die Mammouth-App und ihre erneuerbare Nutzungserlaubnis; API-Aufrufe verbrauchen ein dollardenominiertes API-Guthaben.
Mammouth AI Tarife auf einen Blick
| Tarif | Monatlicher Preis | Chat-Kontingent | Inklusive API-Gutschrift | Beste Anwendung |
|---|---|---|---|---|
| Starter | $12 in der geprüften US-Ansicht | Referenzkontingent | $2/Monat | Regelmäßige individuelle Nutzung |
| Standard | $24 in der geprüften US-Ansicht | 3× Starter | $4/Monat | Häufige Reasoning-, Dokument- oder Bildarbeit |
| Expert | $72 in der geprüften US-Ansicht | 10× Starter | $10/Monat | Schwere professionelle Nutzung über Modelle und Media-Tools |
Die obigen Dollarpreise sind die US-Region-Anzeige, die am 30. Juli 2026 überprüft wurde; Mammouth's offizielle Seite lokalisiert Währung und Steuerbehandlung, also überprüfe den angezeigten Betrag für deinen Standort. Die inklusive API-Gutschrift stammt aus Mammouth's API-Dokumentation.[1][3] Mammouth bietet auch Team-Arbeitsbereiche zum ausgewählten Pro-Kopf-Tarif an, mit zentralisierter Abrechnung und gemeinsamen Projekten; Enterprise-Preise erfordern ein Angebot.
Alle drei Einzeltarife enthalten das gleiche breite Produkt: eine gehostete Chat-Schnittstelle mit Zugriff auf Modellgruppen von Anbietern wie OpenAI, Anthropic, Google, Mistral, xAI, DeepSeek und anderen. Die App listet auch Web-Recherche, Bild- und Videogenerierung, Projekte, Sprachfunktionen und Coding-Tools auf. Ein höherer Tarif bietet primär mehr Nutzung, nicht eine völlig andere Anwendung.
Wie das Drei-Stunden-Kontingent funktioniert
Mammouth veröffentlicht keine einzelne Zahl für „Nachrichten pro Monat". Seine Quota-Dokumentation sagt, dass Limits pro Sitzung definiert sind und sich nach drei Stunden vollständig erneuern.[2] Die Menge, die ein Austausch verbraucht, hängt davon ab, was dieser Austausch vom Service verlangt.
Lange Prompts und Antworten kosten mehr Kontingent als kurze. Große Dokumente addieren Input. Ein langes Gespräch wird mit der Zeit progressiv teurer, da der vorherige Kontext erneut gesendet wird. Web-Suche und Dokumentgenerierungs-Tools addieren Arbeit, und ein leistungsfähigeres Modell verbraucht mehr als ein leichteres.
Das macht die Headline-Multiplikatoren hilfreicher als der Versuch, jeden Tarif in eine genaue Nachrichtenanzahl zu übersetzen:
- Starter ist das Referenzkontingent. Es eignet sich für regelmäßiges Chat und gelegentliche Nutzung von teuren Tools.
- Standard bietet das Dreifache des Starter-Kontingents. Es ist der sicherere Mittelplan für tägliche Dokumentarbeit, Reasoning-Modelle oder wiederholte Bildgenerierung.
- Expert bietet das Zehnfache des Starter-Kontingents. Es zielt auf Nutzer ab, die regelmäßig die teuren Modelle oder Media-Tools ausführen.
Bei den angezeigten Preisen von 12/24/72 kostet Expert sechsmal so viel wie Starter, hat aber zehnmal das relative Kontingent. Das ist ein besseres Kontingent-zu-Preis-Verhältnis, obwohl es nur Geld spart, wenn die Extra-Erlaubnis tatsächlich genutzt wird.
Das Erreichen eines Kontingents stoppt nicht immer den Chat
Mammouth verwendet Modell-Schwellwerte. Wenn ein Nutzer das Kontingent für ein anspruchsvolles Modell ausschöpft, kann die App das Gespräch auf ein leichteres Modell umschalten, bis sich das Kontingent erneuert. Seine Dokumentation gibt ein Claude-Beispiel: Opus kann zu Sonnet fallen, dann Sonnet zu Haiku.[2]
Das hält eine Sitzung laufen, bedeutet aber auch, dass „ich kann immer noch Nachrichten senden" kein Beweis ist, dass das ursprüngliche Modell noch aktiv ist. Jeder, der einen Tarif für ein bestimmtes Premium-Modell auswählt, sollte das angezeigte Modell in der Schnittstelle während einer langen Sitzung beobachten und die Arbeitslast über ein volles Drei-Stunden-Fenster testen.
Abonnement-Kontingent und API-Gutschrift sind unterschiedlich
Der einfachste Pricing-Fehler ist, den inklusive API-Gutschrift als Geldversion des App-Kontingents zu behandeln. Das ist es nicht.
Das Chat-Abonnement deckt die Nutzung in Mammouth's gehostem Produkt ab, unter Berücksichtigung des erneuerbaren Kontingents. Der inklusive API-Gutschrift ist ein separates monatliches Guthaben für Aufrufe mit einem API-Schlüssel:
| Abonnement | Inklusive monatliche API-Gutschrift |
|---|---|
| Starter | $2 |
| Standard | $4 |
| Expert | $10 |
Mammouth's API-Anleitung besagt, dass alle Abonnenten diese Guthaben erhalten. Es erlaubt auch Pay-as-you-go Finanzierung aus den API-Einstellungen, so ein API-only Entwickler braucht nicht erst ein Starter-Abonnement zu kaufen.[3]
API-Nutzung wird nach Modell und Tokens bepreist. Die veröffentlichte Modell-Tabelle enthält separate Input- und Output-Raten, und Mammouth warnt, dass sich die Tabelle ändern kann; ihr Model Explorer ist die aktuelle Quelle für den vollständigen Katalog. Der Service besagt, dass die angezeigten Raten Obergrenzen sind und die tatsächliche Gebühr niedriger sein kann, wenn die Verfügbarkeit des Anbieters es zulässt.[3]
In der Praxis:
- kaufe einen Chat-Plan, wenn Menschen in der Mammouth-Schnittstelle arbeiten werden;
- verwende PAYG, wenn Software, eine Automatisierung oder ein internes Tool die Aufrufe macht;
- zähle den inklusive API-Gutschrift als kleine Entwickler-Erlaubnis, nicht als Hauptwert des Plans;
- preise eine API-Arbeitslast von ihrem eigentlichen Modell, Input-Tokens und Output-Tokens statt des Abonnement-Multiplikators.
Was der Mammouth API-Zugang umfasst
Mammouth dokumentiert eine OpenAI-kompatible chat-completions API auf https://api.mammouth.ai/v1. Vorhandener OpenAI Client-Code kann normalerweise auf diese Basis-URL zeigen, einen Mammouth-Schlüssel verwenden und das vertraute Nachrichtenformat beibehalten.[3]
Die API ist nützlich, wenn ein Team einen Endpoint für mehrere LLM-Anbieter möchte, oder Modelle mit Tools wie n8n, Make, Cline oder einer internen Anwendung verbinden muss. Es ist nicht dieselbe Produkterfahrung wie die Mammouth Chat-App. Projekte, gehostete Gespräche, Sprachsteuerung und andere Schnittstellenfunktionen erscheinen nicht automatisch in einer API-Integration.
Zwei Budgetierungsdetails sind leicht zu übersehen:
- Ein langer System-Prompt und Gesprächs-Historie sind Input-Tokens bei jeder Anfrage.
- Modell-Aliase können sich im Laufe der Zeit ändern. Mammouth's
mammouth-recommendedAlias ist explizit dafür ausgelegt, seiner aktuellen Preis-Leistungs-Auswahl zu folgen, also fixiere eine Modell-ID, wenn Reproduzierbarkeit wichtig ist.
Dokument- und Dateigrößenlimits
Kontingent ist nur ein Limit. Mammouth's Dokumentation veröffentlicht auch harte Grenzen für hochgeladenes Material:[2]
| Limit | Veröffentlichtes Maximum |
|---|---|
| Gesamte Input-Länge | 4.000.000 Zeichen |
| Dateien in einem Gespräch | 20 |
| Kombinierte Dateigröße | 100 MB |
| Einzelnes PDF | 100 MB |
| Einzelne Nicht-PDF-Datei | 20 MB |
| Nur-Bild/gescanntes PDF | 50 Seiten und 20 MB |
| Standard extrahierter Text | 30.000 Zeichen |
| Large-context extrahierter Text | 150.000 Zeichen |
Das Vier-Millionen-Zeichen-Input-Limit umfasst den Dokumentinhalt, Prompt und benutzerdefinierte Anweisungen. Bei langen oder mehreren Dokumenten kann Mammouth die Teile extrahieren, die es als am relevantesten erachtet, statt jedes Zeichen in den ausgewählten Modell-Kontext zu übergeben. Eine Datei, die akzeptiert wird, garantiert daher nicht, dass jede Seite in den Modell-Kontext gelangt.
Für dokumentenlastige Arbeit, teste das Abrufen mit Fragen, deren Antworten am Anfang, in der Mitte und am Ende der Quelle sitzen. Wenn die Anwendung späte oder obskure Details verpasst, kann das Aufteilen des Dokuments nach Thema effektiver sein als die Aufrüstung ausschließlich für ein größeres Kontingent.
Welcher Mammouth Tarif macht Sinn?
Wähle Starter wenn die Nutzung hauptsächlich normales Chat, Suche und gelegentliche kreative Arbeit ist. Es ist auch die kostengünstigste Methode, um die komplette gehostete App zu evaluieren, obwohl Entwickler, die nur die API testen, stattdessen mit PAYG beginnen können.
Wähle Standard wenn Starter's Premium-Modell-Schwelle regelmäßig innerhalb des Drei-Stunden-Fensters erreicht wird. Der dreifache Kontingent-Anstieg ist ein bedeutender Schritt, ohne den großen Sprung zu Expert.
Wähle Expert wenn teure Reasoning, große Dokumente oder Media-Generierung Teil der täglichen bezahlten Arbeit sind. Das zehnfache Kontingent hat den stärksten Wert pro Einheit, aber der Top-Tarif-Monatspreis kann schwer zu rechtfertigen sein, wenn die Nutzung intermittierend bleibt.
Upgraden nicht ausschließlich für API-Zugang. Schätze erst die API-Rechnung basierend auf den beabsichtigten Modellen und Token-Volumen, dann vergleiche PAYG mit dem inklusive Guthaben. Ebenso, nicht annehmen, dass Expert jeden Schwellwert entfernt: Mammouth beschreibt den Service weiterhin als kontingentbasiert.
Wo reAPI passt — und wo nicht
Offenlegung: Wir betreiben reAPI. reAPI ist ein Developer API Service, kein Mammouth-ähnliches Consumer-Abonnement, sollte also nicht als Ersatz für Mammouth's gehostete Chat, Projekte oder Drei-Stunden-App-Erlaubnis dargestellt werden.
Es wird relevant, wenn die Anforderung sich von „welchen Mammouth Chat-Tarif sollte ich kaufen?" zu „welche API sollte meine Anwendung aufrufen?" verschiebt.
| Entscheidungspunkt | Mammouth | reAPI |
|---|---|---|
| Hauptprodukt | Gehostete Multi-Modell Chat und kreative App | Developer API für Modelle in deinem eigenen Produkt |
| API-Fokus | OpenAI-kompatible LLM Zugang neben der Abonnement-App | OpenAI-kompatible Chat plus dedizierte Bild-, Video- und Audio-Endpoints |
| Abrechnung | App-Abonnement plus optionales API PAYG Guthaben | PAYG Credits ohne erforderliches monatliches Abonnement |
| Nutzer-Schnittstelle | Fertig Chat, Projekte, Dateien und Creator-Tools | Modell-Playground und API; dein Team baut die Customer-Schnittstelle |
| Beste Anwendung | Eine Person, die einen ready-made AI Arbeitsbereich möchte | Ein SaaS oder internes Tool, das programmierbaren Modell-Zugang braucht |
Wenn du ein fertiges Chat-Produkt möchtest, ist Mammouth die bessere Wahl. Wenn du Modelle in Software platzieren möchtest, die du kontrollierst, durchsuche den reAPI Modell-Katalog und führe die erste Arbeitslast durch die API Quickstart aus. Vergleiche Live-Modell-Verfügbarkeit, Ausgabequalität, Datenbehandlung und Gesamtkosten auf denselben repräsentativen Anfragen.
Leser, die zu dem Ergebnis gekommen sind, dass Mammouth selbst das falsche Produkt ist, können den separaten Mammouth AI Alternativen Leitfaden verwenden. Dieser Artikel behandelt Consumer und Developer Ersatz ausführlicher.
FAQ
Wie viel kostet Mammouth AI?
In der US-Region-Ansicht, die am 30. Juli 2026 überprüft wurde, zeigte Mammouth Starter mit $12 pro Monat, Standard mit $24 und Expert mit $72 vor VAT. Andere Regionen können lokale Währung und Steuern inklusive Preise anzeigen. Standard umfasst das Dreifache des Starter-Kontingents; Expert umfasst das Zehnfache des Starter-Kontingents.[1][2]
Ist Mammouth AI unbegrenzt?
Nein. Nutzungs-Kontingente erneuern sich vollständig nach drei Stunden. Wenn ein Modell-Schwellwert erreicht wird, kann Mammouth das Gespräch auf ein leichteres Modell umschalten, bis die Erlaubnis sich erneuert.[2]
Umfasst ein Mammouth Abonnement API-Zugang?
Ja. Starter, Standard und Expert umfassen $2, $4 und $10 monatliche API-Gutschrift jeweils. Das API-Guthaben ist vom Chat-Kontingent der App getrennt.[3]
Kann ich die Mammouth API ohne Abonnement verwenden?
Ja. Mammouth dokumentiert Pay-as-you-go API-Finanzierung ohne erforderliches Consumer Chat-Abonnement.[3]
Wann erneuern sich Mammouth Kontingente?
Mammouth besagt, dass Kontingente sich nach drei Stunden vollständig erneuern. Der Verbrauch variiert mit dem ausgewählten Modell, Gesprächs-Länge, Prompt- und Antwort-Länge, hochgeladenen Dokumenten und verwendeten Tools.[2]
Ist VAT in Mammouth's angezeigtem Preis enthalten?
Es hängt vom Standort ab. Die offizielle Seite zeigte Preise ohne VAT in einer US-Region-Ansicht und VAT-inklusive Euro-Preise in einer europäischen Ansicht, als sie am 30. Juli 2026 überprüft wurde. Verwende die Währung und Steuerbehandlung, die für deine Region an der Kasse angezeigt werden.[1]
Ist reAPI eine Mammouth Alternative?
Es ist eine Alternative zu Mammouth's API Layer, nicht zur fertigen Mammouth Chat-App. Wähle Mammouth, wenn Personen seinen gehosteten Arbeitsbereich brauchen. Wähle reAPI, wenn Entwickler Chat-, Bild-, Video- oder Audio-Modelle hinter einer Anwendung brauchen, die sie kontrollieren.
References
- Mammouth AI. Pricing. Regionally-localized Starter, Standard, Expert, team, and enterprise plan information. Retrieved July 30, 2026 from mammouth.ai/pricing
- Mammouth AI. Quota System & Usage Limitations. Three-hour renewal, plan multipliers, fallback behavior, and document limits. Retrieved July 30, 2026 from info.mammouth.ai/docs/quota-policy
- Mammouth AI. API Documentation. Included monthly credits, PAYG access, OpenAI compatibility, model pricing, and aliases. Retrieved July 30, 2026 from info.mammouth.ai/docs/api-quick-start
Autor

Kategorien
Weitere Beiträge

Seedance 2.0 Sicherheitsfilter: Was sie blocken und warum
Seedance 2.0 filtert auf mehreren Ebenen; ein Fehler nennt selten die aktive Ebene. Was jede Ebene blockt und welche Grenzen überall gelten.


Das Kontextfenster in Claude: Was zählt bei der Nutzung
Das Kontextfenster in Claude hat 1M Token, aber Werkzeugdefs, beibehaltenes Denken und Cache verbrauchen es alle. Mehr ist nicht automatisch besser.


Nano Banana API: Es gibt keinen kostenlosen Tarif
Es gibt keinen Nano Banana API kostenlosen Tarif – Google verzeichnet ihn als nicht verfügbar. Echte Pro-Bild-Sätze, Batch-Preise und was $0,02 kostet.
