GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
Beste Content Moderation API: Text, Bild und Video im Vergleich
2026/10/07

Beste Content Moderation API: Text, Bild und Video im Vergleich

Die beste Content Moderation API je Anwendungsfall: OpenAI, Azure, AWS, Google, Hive, Sightengine und Mistral nach Modalität, Kategorien, Abrechnung und Self-Hosting.

Welche Content Moderation API die beste ist, hängt weniger von Genauigkeitsversprechen ab als von vier nüchternen Fakten: welche Medien sie liest, welche Kategorien sie meldet, wie sie abrechnet und ob Sie sie selbst betreiben können. OpenAIs omni-moderation-latest ist kostenlos und liest Text und Bilder[1][2], bewertet auf Bildern aber nur 6 seiner 13 Kategorien und klassifiziert kein Audio[2]. Amazon Rekognition moderiert Video und rechnet pro Minute ab[3]. Mistral veröffentlicht offene Gewichte für ein multimodales Moderationsmodell[4]. Solche Unterschiede entscheiden die Wahl öfter als jeder Benchmark.

Dieser Vergleich umfasst elf Optionen, jeweils im Oktober 2026 gegen die Dokumentation und Preisseiten des Anbieters geprüft. Er beschränkt sich darauf, was jede API abdeckt und wie sie abrechnet. Die konkreten Preise pro Element und eine Beispielrechnung finden Sie unter Ist die OpenAI Moderation API kostenlos?.

TL;DR

  • Text und Bilder mit kleinem Budget: der Moderation-Endpoint von OpenAI, kostenlos für OpenAI-API-Nutzer, 13 Kategorien[1][2].
  • Text mit PII- und Jailbreak-Erkennung: Mistral Moderation 2, als kostenlos gelistet, 11 Textkategorien[5][6].
  • Video: Amazon Rekognition (gespeichertes und Streaming-Video, Abrechnung pro Minute) oder Sightengine (Video in bezahlten Plänen, Livestreams im Pro-Plan)[3][7].
  • Feingranulare Bild-Labels: Rekognitions dreistufige Taxonomie mit 10 Hauptkategorien oder die über 120 Bildklassen von Sightengine[8][7].
  • Self-Hosting: Mistrals Shieldstral 1.0 (Apache-2.0-Gewichte, Public Preview) oder Azures Disconnected Containers mit Commitment-Plan[4][9].
  • Für neue Projekte meiden: Perspective API, die nach dem 31. Dezember 2026 abgeschaltet wird[10].

Was eine Content Moderation API von der anderen unterscheidet

Die meisten Moderation-APIs liefern dieselbe Art von Antwort: eine Reihe von Kategorien mit jeweils einem Score oder Schweregrad. Die Unterschiede, die im Betrieb zählen, liegen woanders.

Modalität. Reine Text-APIs helfen bei hochgeladenen Fotos nicht, und Bild-APIs lesen keine Bildunterschriften. Video ist noch seltener: Von den Optionen unten führen nur Amazon Rekognition, Sightengine und Hive Video-Moderation, und Hive schaltet sie über ein Kontaktformular frei[3][7][11].

Kategoriendesign. OpenAI liefert 13 Schadenskategorien als Booleans plus Scores von 0 bis 1[2]. Azure liefert vier Kategorien (Hass, Sexuelles, Gewalt, Selbstverletzung) mit einem Schweregrad von 0 bis 7 für Text und 0, 2, 4 oder 6 für Bilder[12]. Google Natural Language liefert 16 Attribute, darunter mehrere sensible Themen statt Schäden, etwa Health, Finance, Politics und Legal[13]. Wählen Sie das Design, das zu Ihrer Richtlinie passt.

Abrechnungseinheit. Anbieter zählen Zeichen, Text Records, Requests, Bilder, Minuten oder "Operations", und die Einheit bestimmt, welche Eingaben günstig sind. Ein Kommentar mit 50 Zeichen ist bei Hive ein Request, wird bei Amazon Comprehend aber als 300 Zeichen berechnet[11][14]. Der Preisvergleich erklärt jede Einheit.

Wo sie läuft. Jede gehostete API schickt die Inhalte Ihrer Nutzer an einen Dritten. Ist das nicht akzeptabel, bleiben nur die Optionen mit herunterladbaren Gewichten oder Containern.

Vergleichstabelle: die beste Content Moderation API

APITextBildVideoKategorienAbrechnungseinheitKostenlose NutzungSelf-Hosting
OpenAI omni-moderation-latestJaJa (6 von 13 Kategorien)Nicht angegeben13 Schadenskategorien, Score 0 bis 1[2]Keine (kostenlos)Kostenlos, innerhalb der Rate Limits[1]Nein
Azure AI Content SafetyJaJaNicht angegeben4 Kategorien, Schweregrad 0 bis 7[12]Text Record (1.000 Zeichen), Bild5.000 Text Records + 5.000 Bilder pro Monat[9]Disconnected Containers, Jahres-Commitment[9]
Amazon RekognitionNeinJaJaDreistufige Taxonomie, 10 Hauptkategorien[8]Bild, Videominute1.000 Bilder + 60 Videominuten pro Monat für 12 Monate[3]Nein
Amazon Comprehend ToxicityNur EnglischNeinNicht angegeben7 Labels[15]100 Zeichen, mindestens 3 EinheitenNicht auf der Free-Tier-Liste[14]Nein
Google Cloud Vision SafeSearchNeinJaNicht angegeben5 Wahrscheinlichkeiten: adult, spoof, medical, violence, racy[16]Bild1.000 Einheiten pro Monat[17]Nein
Google Natural Language Text ModerationJaNeinNicht angegeben16 Attribute, Konfidenz 0 bis 1[13]100 Zeichen50.000 Einheiten pro Monat[18]Nein
HiveJaJaÜber KontaktformularAuf der Preisseite nicht aufgeführtRequest; Audio pro Minute$50+ Guthaben nach Hinterlegen einer Zahlungsmethode[11]Nein
SightengineJaJa (120+ Klassen)Ja; Livestreams im Pro-Plan120+ Bildklassen[7]Operation2.000 Operations pro Monat[7]Nein
Mistral Moderation 2JaNeinNicht angegeben11, inkl. PII und Jailbreaking[6]Keine (kostenlos)Als kostenlos gelistet[5]Nein
Mistral Shieldstral 1.0JaJaNicht angegebenEigene Ja/Nein-Richtlinienfragen[4]Ihre HardwareOffene GewichteJa, Apache 2.0
reAPI Content ModerationJaJa (Bild-URLs)NeinDieselben 13 wie omni-moderation-latest[19]1.000 Wörter Text oder 1 BildKostenpflichtigNein

Audio ist ein eigener Bedarf. OpenAIs Modell klassifiziert es nicht[2]; Hive berechnet Audio-Moderation pro Minute, und Sightengine enthält sie im Pro-Plan[11][7].

Die beste Content Moderation API nach Anwendungsfall

Chat, Kommentare und LLM-Prompts

Für Text in einer Chat-App, einem Kommentarbereich oder einer LLM-Pipeline starten Sie mit einer kostenlosen Option. OpenAIs Endpoint deckt die Familien Belästigung, Hass, Illegales, Selbstverletzung, Sexuelles und Gewalt mit Unterkategorien ab[2], und die Responses API kann Moderation-Scores für Ein- und Ausgabe eines Modells im selben Aufruf liefern[2]. Mistral Moderation 2 ergänzt Kategorien, die OpenAI nicht hat: PII, Jailbreaking und Anfragen nach individueller Gesundheits-, Finanz- oder Rechtsberatung[6]. Geht es Ihnen um Prompt Injection oder Nutzer, die persönliche Daten abgreifen wollen, passt diese Liste besser.

Wählen Sie Azure, wenn Sie abgestufte Schweregrade statt einer Wahrscheinlichkeit wollen oder eigene Kategorien definieren müssen (in Preview)[12][20]. Die Content-Safety-Modelle von Azure sind auf acht Sprachen trainiert und getestet und funktionieren in anderen Sprachen mit schwankender Qualität[20]. Die Toxicity Detection von Amazon Comprehend unterstützt nur Englisch[15].

Von Nutzern hochgeladene Bilder

Allzweckmodelle sind bei Bildern dünner aufgestellt. OpenAI wendet auf ein Bild nur die Familien Selbstverletzung, Sexuelles und Gewalt an; Belästigung, Hass und Illegales gelten nur für Text[2]. Azure deckt seine vier Kategorien auch auf Bildern ab[12].

Nennt Ihre Richtlinie Dinge wie Badebekleidung, Alkohol, Glücksspiel, Drogen, obszöne Gesten oder Hasssymbole, nehmen Sie einen Bildspezialisten. Rekognition führt diese als Hauptkategorien[8], und Sightengine listet mehr als 120 Bildklassen[7]. Unser Leitfaden zur Image Moderation API geht tiefer auf Bildeingaben, Schwellenwerte und Code ein.

Video und Livestreams

Rekognition analysiert gespeichertes Video aus Amazon S3 und Streaming-Video-Events und rechnet pro verarbeiteter Minute ab[3]. Sightengine verarbeitet Videodateien bis 50 MB im Starter-Plan und bis 500 MB plus Livestreams im Pro-Plan[7]. Hive extrahiert Frames in einer von Ihnen festgelegten Abtastrate, nachdem Sie Video über das Kontaktformular freigeschaltet haben[11].

Daten, die Ihre Infrastruktur nicht verlassen dürfen

Mistrals Shieldstral 1.0 ist ein Modell mit 3,8 Mrd. Parametern unter Apache 2.0, das Text- und Bildeingaben anhand von Richtlinienfragen in natürlicher Sprache klassifiziert, mit 32k Token Kontext. Es befindet sich in der Public Preview[4]. Azure verkauft Content Safety als Disconnected Containers mit Jahres-Commitment in Größenordnungen von Hunderten Millionen Records[9], was eher zu Großunternehmen als zu kleinen Teams passt.

Bereits auf der Perspective API

Jigsaw stellt Perspective ein. Der Dienst läuft bis zum 31. Dezember 2026, neue Nutzungs- und Kontingentanfragen wurden nur bis Februar 2026 angenommen, und es gibt keine Migrationsunterstützung[10]. Planen Sie den Umstieg jetzt. Wenn Sie Toxizitäts-Attribute brauchen: Google Natural Language Text Moderation liefert unter seinen 16 Attributen Toxic, Insult und Profanity[13].

Moderation neben Generierung auf reAPI

Wenn Sie bereits Bilder, Videos oder Text über reAPI generieren, führt Content Moderation omni-moderation-latest mit demselben Key, demselben Guthaben und demselben Task-Vertrag aus. Es ist asynchron: an /api/v1/moderations senden, dann den Task pollen[21]. Das unterscheidet sich von OpenAIs synchroner Antwort, daher ist es kein Drop-in für OpenAI-SDK-Integrationen. Abgerechnet wird pro Moderation-Einheit; den aktuellen Preis finden Sie auf der Modellseite[19].

Ist die OpenAI Moderation API gut genug?

Die Frage stammt direkt aus Entwicklerforen, und die Antwort lautet "für viele Text-Workloads ja". Sie ist kostenlos, deckt 13 Kategorien ab und akzeptiert Batches von Strings[1][2]. Ihre Grenzen sind dokumentiert, sodass Sie sie mit Ihrem Fall abgleichen können:

  • Sieben Kategorien ignorieren Bilder, eine bildlastige Plattform erhält also nur eine Teilabdeckung[2].
  • Audio wird nicht klassifiziert, und OpenAI dokumentiert nur Text- und Bildeingaben[2].
  • OpenAI aktualisiert das Modell laufend, und Schwellenwerte auf Basis von category_scores "may need recalibration"[2].
  • Sie ist nicht für die Erkennung von CSAM ausgelegt; OpenAI rät, solches Material nicht dorthin zu senden[2].
  • Der Durchsatz ist je Usage Tier begrenzt, beginnend bei 5.000 Requests pro Tag im Free Tier[22].

Schließt keiner dieser Punkte sie aus, ist sie die Standardwahl. Schließt einer sie aus, zeigt die Tabelle oben, welche API die Lücke füllt.

FAQ

Ist die OpenAI Moderation API gut genug?

Für Text-Moderation innerhalb ihrer 13 Kategorien oft ja, und sie kostet nichts[1]. Sie reicht nicht, wenn Sie Audio oder Video brauchen, Bildprüfungen über die Familien Selbstverletzung, Sexuelles und Gewalt hinaus oder Kategorien wie PII und Jailbreaking[2][6].

Azure Content Moderation API

Azures aktuelles Produkt ist Azure AI Content Safety mit getrennten APIs Analyze Text und Analyze Image, die Hass, Sexuelles, Gewalt und Selbstverletzung mit Schweregraden bewerten[20][12]. Dazu kommen Prompt Shields, Erkennung geschützter Inhalte und eigene Kategorien[20]. Das Free Tier umfasst 5.000 Text Records und 5.000 Bilder pro Monat[9].

Content Moderation API von Google

Google verteilt Moderation auf zwei APIs: Cloud Vision SafeSearch für Bilder mit fünf Wahrscheinlichkeitskategorien[16] und Cloud Natural Language Text Moderation für Text mit 16 Attributen[13]. Beide haben monatliche Freikontingente[17][18].

Amazon Rekognition Content Moderation API

Rekognition moderiert Bilder über DetectModerationLabels und moderiert außerdem gespeichertes und Streaming-Video[3]. Die Labels folgen einer dreistufigen Taxonomie mit 10 Hauptkategorien, von Explicit und Violence bis Gambling und Hate Symbols[8]. Für Text auf AWS ist die Toxicity Detection von Amazon Comprehend die separate, nur englische Option[15].

Moderation API von Mistral

Mistral bietet mistral-moderation-2603 (Mistral Moderation 2) auf /v1/moderations an, mit 128k Kontext und kostenlos gelistetem Preis[5]. Das Modell klassifiziert Text in 11 Kategorien, darunter PII und Jailbreaking[6]. Sein Geschwistermodell mit offenen Gewichten, Shieldstral 1.0, liest auch Bilder[4].

Video Moderation API

Amazon Rekognition, Sightengine und Hive führen Video-Moderation; die Moderation-APIs von OpenAI, Azure Content Safety, Google und Mistral in diesem Vergleich dokumentieren nur Text- oder Bildeingaben[3][7][11]. Mit einer Text-und-Bild-API können Sie selbst Frames entnehmen und als Bilder senden, so beschreibt auch Hive seine eigene Videoverarbeitung[11].

Beste Image Moderation API

Für breite Bildrichtlinien mit Labels wie Alkohol, Glücksspiel oder Hasssymbolen: Rekognition oder Sightengine[8][7]. Geht es nur um Sexuelles, Gewalt und Selbstverletzung, deckt der kostenlose OpenAI-Endpoint auch Bilder ab[2]. Details im Leitfaden zur Image Moderation API.

Open-Source Moderation API

Mistrals Shieldstral 1.0 ist mit Apache-2.0-Gewichten veröffentlicht und verarbeitet Text und Bilder; es befindet sich in der Public Preview[4]. Wenn Sie stattdessen Azures Modelle in Ihrer eigenen Infrastruktur brauchen, verkauft Azure Content Safety als Disconnected Containers mit Jahres-Commitment[9].

Die beste Content Moderation API für Ihren Stack wählen

Beginnen Sie bei den Medien, die Sie prüfen müssen. Reine Textprodukte können mit dem kostenlosen OpenAI-Endpoint oder Mistral Moderation 2 starten und zu Azure wechseln, sobald sie Schweregrade oder eigene Kategorien brauchen. Bildlastige Produkte sollten sich Rekognition oder Sightengine wegen der Label-Tiefe ansehen, und alles mit Video reduziert die Auswahl auf Rekognition, Sightengine oder Hive. Dürfen Inhalte Ihre Server nicht verlassen, sind die offenen Gewichte von Shieldstral der realistische Weg.

Zwischen den verbleibenden Kandidaten entscheidet meist der Preis, und der Preisvergleich der Moderation-APIs liefert die Zahlen. Wenn Sie omni-moderation-latest mit demselben asynchronen Vertrag wie Ihre anderen reAPI-Modelle nutzen wollen, sehen Sie sich die Modellseite von Content Moderation an. So oder so ist die beste Content Moderation API diejenige, deren Kategorien zu der Richtlinie passen, die Sie tatsächlich durchsetzen.

Referenzen

  1. OpenAI. Is the Moderation endpoint free to use? Abgerufen im Oktober 2026 von help.openai.com/en/articles/4936833-is-the-moderation-endpoint-free-to-use
  2. OpenAI. Moderation guide. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/guides/moderation
  3. Amazon Web Services. Amazon Rekognition pricing. Abgerufen im Oktober 2026 von aws.amazon.com/rekognition/pricing
  4. Mistral AI. Shieldstral 1.0 model card. Abgerufen im Oktober 2026 von docs.mistral.ai/models/shieldstral-1-0
  5. Mistral AI. Mistral Moderation 2 model card. Abgerufen im Oktober 2026 von docs.mistral.ai/models/mistral-moderation-26-03
  6. Mistral AI. Moderation and guardrailing. Abgerufen im Oktober 2026 von docs.mistral.ai/studio/conversations/moderation
  7. Sightengine. Pricing. Abgerufen im Oktober 2026 von sightengine.com/pricing
  8. Amazon Web Services. Using the image and video moderation APIs, Amazon Rekognition Developer Guide. Abgerufen im Oktober 2026 von docs.aws.amazon.com/rekognition/latest/dg/moderation-api.html
  9. Microsoft Azure. Content Safety pricing. Abgerufen im Oktober 2026 von azure.microsoft.com/en-us/pricing/details/content-safety
  10. Jigsaw. Perspective API sunset announcement. Abgerufen im Oktober 2026 von perspectiveapi.com
  11. Hive. Pricing. Abgerufen im Oktober 2026 von thehive.ai/pricing
  12. Microsoft Learn. Harm categories in Azure AI Content Safety. Abgerufen im Oktober 2026 von learn.microsoft.com/en-us/azure/ai-services/content-safety/concepts/harm-categories
  13. Google Cloud. Moderate text, Cloud Natural Language API. Abgerufen im Oktober 2026 von docs.cloud.google.com/natural-language/docs/moderating-text
  14. Amazon Web Services. Amazon Comprehend pricing. Abgerufen im Oktober 2026 von aws.amazon.com/comprehend/pricing
  15. Amazon Web Services. Trust and safety, Amazon Comprehend Developer Guide. Abgerufen im Oktober 2026 von docs.aws.amazon.com/comprehend/latest/dg/trust-safety.html
  16. Google Cloud. Detect explicit content (SafeSearch). Abgerufen im Oktober 2026 von docs.cloud.google.com/vision/docs/detecting-safe-search
  17. Google Cloud. Cloud Vision API pricing. Abgerufen im Oktober 2026 von cloud.google.com/vision/pricing
  18. Google Cloud. Cloud Natural Language pricing. Abgerufen im Oktober 2026 von cloud.google.com/natural-language/pricing
  19. reAPI. Content Moderation model page. reapi.ai/models/content-moderation
  20. Microsoft Learn. What is Azure AI Content Safety? Abgerufen im Oktober 2026 von learn.microsoft.com/en-us/azure/ai-services/content-safety/overview
  21. reAPI. Content Moderation API docs. reapi.ai/docs/content-moderation
  22. OpenAI. omni-moderation model page. Abgerufen im Oktober 2026 von developers.openai.com/api/docs/models/omni-moderation-latest