GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
Meilleure API de modération de contenu : texte, image et vidéo
2026/10/07

Meilleure API de modération de contenu : texte, image et vidéo

La meilleure API de modération de contenu selon l'usage : OpenAI, Azure, AWS, Google, Hive, Sightengine et Mistral comparés par modalité, catégories, facturation et auto-hébergement.

La meilleure API de modération de contenu dépend moins des promesses de précision que de quatre faits simples : les médias qu'elle lit, les catégories qu'elle renvoie, sa façon de facturer et la possibilité de l'exécuter vous-même. omni-moderation-latest d'OpenAI est gratuit et lit le texte et les images[1][2], mais il n'évalue que 6 de ses 13 catégories sur les images et ne classe pas l'audio[2]. Amazon Rekognition modère la vidéo à la minute[3]. Mistral publie les poids ouverts d'un modèle de modération multimodal[4]. Ces différences décident du choix plus souvent que n'importe quel benchmark.

Ce comparatif couvre onze options, chacune vérifiée en octobre 2026 dans la documentation et sur les pages de tarifs du fournisseur. Il s'en tient à ce que couvre chaque API et à sa facturation. Pour les prix par élément et un exemple chiffré, voir L'API de modération d'OpenAI est-elle gratuite ?.

En bref

  • Texte et images à petit budget : l'endpoint de modération d'OpenAI, gratuit pour les utilisateurs de l'API OpenAI, 13 catégories[1][2].
  • Texte avec détection de PII et de jailbreak : Mistral Moderation 2, affiché comme gratuit, 11 catégories texte[5][6].
  • Vidéo : Amazon Rekognition (vidéo stockée et en streaming, facturée à la minute) ou Sightengine (vidéo dans les offres payantes, direct dans l'offre Pro)[3][7].
  • Étiquettes d'image fines : la taxonomie à trois niveaux de Rekognition avec 10 catégories principales, ou les plus de 120 classes d'image de Sightengine[8][7].
  • Auto-hébergement : Shieldstral 1.0 de Mistral (poids Apache 2.0, préversion publique) ou les conteneurs déconnectés d'Azure avec engagement[4][9].
  • À éviter pour les nouveaux projets : Perspective API, qui cesse de fonctionner après le 31 décembre 2026[10].

Ce qui distingue une API de modération de contenu d'une autre

La plupart des API de modération renvoient le même type de réponse : un ensemble de catégories avec chacune un score ou une gravité. Les différences qui comptent en production sont ailleurs.

Modalité. Les API texte seul ne servent à rien pour les photos envoyées, et les API image ne lisent pas les légendes. La vidéo est encore plus rare : parmi les options ci-dessous, seuls Amazon Rekognition, Sightengine et Hive proposent la modération vidéo, et Hive l'active via un formulaire de contact[3][7][11].

Conception des catégories. OpenAI renvoie 13 catégories de préjudice sous forme de booléens et de scores de 0 à 1[2]. Azure renvoie quatre catégories (haine, sexuel, violence, automutilation) avec un niveau de gravité de 0 à 7 pour le texte et de 0, 2, 4 ou 6 pour les images[12]. Google Natural Language renvoie 16 attributs, dont plusieurs sont des sujets sensibles plutôt que des préjudices, comme Health, Finance, Politics et Legal[13]. Choisissez la conception qui correspond à la rédaction de votre politique.

Unité de facturation. Les fournisseurs comptent des caractères, des enregistrements texte, des requêtes, des images, des minutes ou des « opérations », et l'unité change ce qui coûte peu. Un commentaire de 50 caractères est une requête chez Hive, mais il est facturé comme 300 caractères chez Amazon Comprehend[11][14]. Le comparatif des prix explique chaque unité.

Où elle tourne. Toute API hébergée envoie le contenu de vos utilisateurs à un tiers. Si ce n'est pas acceptable, la liste se limite aux options avec des poids ou des conteneurs téléchargeables.

Tableau comparatif de la meilleure API de modération de contenu

APITexteImageVidéoCatégoriesUnité de facturationUsage gratuitAuto-hébergement
OpenAI omni-moderation-latestOuiOui (6 des 13 catégories)Non indiqué13 catégories de préjudice, score de 0 à 1[2]Aucune (gratuit)Gratuit, dans les limites de débit[1]Non
Azure AI Content SafetyOuiOuiNon indiqué4 catégories, gravité de 0 à 7[12]Enregistrement texte (1 000 caractères), image5 000 enregistrements texte + 5 000 images par mois[9]Conteneurs déconnectés, engagement annuel[9]
Amazon RekognitionNonOuiOuiTaxonomie à 3 niveaux, 10 catégories principales[8]Image, minute de vidéo1 000 images + 60 minutes de vidéo par mois pendant 12 mois[3]Non
Amazon Comprehend toxicitéAnglais uniquementNonNon indiqué7 étiquettes[15]100 caractères, minimum 3 unitésAbsent de la liste du palier gratuit[14]Non
Google Cloud Vision SafeSearchNonOuiNon indiqué5 probabilités : adult, spoof, medical, violence, racy[16]Image1 000 unités par mois[17]Non
Google Natural Language Text ModerationOuiNonNon indiqué16 attributs, confiance de 0 à 1[13]100 caractères50 000 unités par mois[18]Non
HiveOuiOuiVia formulaire de contactNon listé sur la page de tarifsRequête ; audio à la minute$50+ de crédits après ajout d'un moyen de paiement[11]Non
SightengineOuiOui (120+ classes)Oui ; direct dans l'offre Pro120+ classes d'image[7]Opération2 000 opérations par mois[7]Non
Mistral Moderation 2OuiNonNon indiqué11, dont PII et jailbreaking[6]Aucune (gratuit)Affiché comme gratuit[5]Non
Mistral Shieldstral 1.0OuiOuiNon indiquéVos propres questions de politique oui/non[4]Votre matérielPoids ouvertsOui, Apache 2.0
reAPI Content ModerationOuiOui (URL d'images)NonLes mêmes 13 que omni-moderation-latest[19]1 000 mots de texte ou 1 imagePayantNon

L'audio est un besoin à part. Le modèle d'OpenAI ne le classe pas[2] ; Hive facture la modération audio à la minute et Sightengine l'inclut dans l'offre Pro[11][7].

Choisir la meilleure API de modération de contenu selon l'usage

Chat, commentaires et prompts de LLM

Pour du texte dans une application de chat, un espace de commentaires ou un pipeline LLM, commencez par une option gratuite. L'endpoint d'OpenAI couvre les familles harcèlement, haine, activités illicites, automutilation, contenu sexuel et violence, avec sous-catégories[2], et la Responses API peut renvoyer des scores de modération pour l'entrée et la sortie d'un modèle dans le même appel[2]. Mistral Moderation 2 ajoute des catégories absentes chez OpenAI : PII, jailbreaking et demandes de conseils personnalisés en santé, finance ou droit[6]. Si votre souci est l'injection de prompts ou des utilisateurs qui cherchent à obtenir des données personnelles, cette liste convient mieux.

Choisissez Azure si vous voulez une gravité graduée plutôt qu'une probabilité, ou si vous devez définir des catégories personnalisées (en préversion)[12][20]. Les modèles Content Safety d'Azure sont entraînés et testés sur huit langues et peuvent fonctionner dans d'autres avec une qualité variable[20]. La détection de toxicité d'Amazon Comprehend ne prend en charge que l'anglais[15].

Images envoyées par les utilisateurs

Les modèles généralistes sont plus limités sur les images. OpenAI n'applique à une image que les familles automutilation, contenu sexuel et violence ; harcèlement, haine et activités illicites sont réservés au texte[2]. Azure couvre ses quatre catégories sur les images[12].

Quand votre politique mentionne maillots de bain, alcool, jeux d'argent, drogues, gestes grossiers ou symboles de haine, utilisez un spécialiste de l'image. Rekognition en fait des catégories principales[8], et Sightengine liste plus de 120 classes d'image[7]. Notre guide de l'API de modération d'images détaille les entrées image, les seuils et le code.

Vidéo et direct

Rekognition analyse la vidéo stockée dans Amazon S3 et les événements vidéo en streaming, facturés à la minute traitée[3]. Sightengine traite des fichiers vidéo jusqu'à 50 Mo dans l'offre Starter, et jusqu'à 500 Mo ainsi que le direct dans l'offre Pro[7]. Hive extrait des images à la fréquence d'échantillonnage que vous fixez, une fois la vidéo activée via son formulaire de contact[11].

Données qui ne doivent pas quitter votre infrastructure

Shieldstral 1.0 de Mistral est un modèle de 3,8 milliards de paramètres publié sous Apache 2.0 qui classe des entrées texte et image à partir de questions de politique en langage naturel, avec un contexte de 32k tokens. Il est en préversion publique[4]. Azure vend Content Safety sous forme de conteneurs déconnectés avec des paliers d'engagement annuel dimensionnés en centaines de millions d'enregistrements[9], ce qui vise les grandes entreprises plutôt que les petites équipes.

Si vous utilisez déjà Perspective API

Jigsaw arrête Perspective. Le service reste actif jusqu'au 31 décembre 2026, les nouvelles demandes d'usage et de quota n'ont été acceptées que jusqu'en février 2026, et aucune aide à la migration n'est prévue[10]. Planifiez la transition dès maintenant. Si vous cherchez des attributs de type toxicité, Google Natural Language Text Moderation renvoie Toxic, Insult et Profanity parmi ses 16[13].

Modération à côté de la génération sur reAPI

Si vous générez déjà des images, des vidéos ou du texte via reAPI, Content Moderation exécute omni-moderation-latest avec la même clé, le même solde de crédits et le même contrat de tâches. Il est asynchrone : vous soumettez à /api/v1/moderations, puis vous interrogez la tâche[21]. C'est différent de la réponse synchrone d'OpenAI, il ne remplace donc pas tel quel les intégrations du SDK OpenAI. La facturation se fait par unité de modération ; le tarif actuel est sur la page du modèle[19].

L'API de modération d'OpenAI est-elle suffisante ?

La question vient tout droit des forums de développeurs, et la réponse est « pour beaucoup de charges texte, oui ». Elle est gratuite, couvre 13 catégories et accepte des lots de chaînes[1][2]. Ses limites sont documentées, vous pouvez donc les confronter à votre cas :

  • Sept catégories ignorent les images, une plateforme riche en images n'obtient donc qu'une couverture partielle[2].
  • Elle ne classe pas l'audio, et OpenAI ne documente que des entrées texte et image[2].
  • OpenAI met le modèle à jour au fil du temps, et les seuils fondés sur category_scores "may need recalibration"[2].
  • Elle n'est pas conçue pour détecter le CSAM ; OpenAI demande de ne pas lui envoyer ce type de contenu[2].
  • Le débit est plafonné par palier d'usage, à partir de 5 000 requêtes par jour au palier Free[22].

Si aucun de ces points ne l'exclut, c'est le choix par défaut. Si l'un d'eux l'exclut, le tableau ci-dessus montre quelle API comble le manque.

FAQ

L'API de modération d'OpenAI est-elle suffisante ?

Pour modérer du texte dans ses 13 catégories, souvent oui, et elle ne coûte rien[1]. Elle ne suffit pas si vous avez besoin d'audio ou de vidéo, de contrôles d'image au-delà des familles automutilation, contenu sexuel et violence, ou de catégories comme PII et jailbreaking[2][6].

API de modération de contenu Azure

Le produit actuel d'Azure est Azure AI Content Safety, avec des API distinctes Analyze Text et Analyze Image qui évaluent haine, contenu sexuel, violence et automutilation avec des niveaux de gravité[20][12]. Il propose aussi Prompt Shields, la détection de contenus protégés et des catégories personnalisées[20]. Le palier gratuit couvre 5 000 enregistrements texte et 5 000 images par mois[9].

API de modération de contenu Google

Google répartit la modération entre deux API : Cloud Vision SafeSearch pour les images, avec cinq catégories de probabilité[16], et Cloud Natural Language Text Moderation pour le texte, avec 16 attributs[13]. Les deux ont des quotas mensuels gratuits[17][18].

API de modération de contenu Amazon Rekognition

Rekognition modère les images via DetectModerationLabels et modère aussi la vidéo stockée et en streaming[3]. Les étiquettes suivent une taxonomie à trois niveaux avec 10 catégories principales, d'Explicit et Violence à Gambling et Hate Symbols[8]. Pour le texte sur AWS, la détection de toxicité d'Amazon Comprehend est l'option séparée, en anglais uniquement[15].

API de modération Mistral

Mistral propose mistral-moderation-2603 (Mistral Moderation 2) sur /v1/moderations, avec un contexte de 128k et un prix affiché gratuit[5]. Il classe le texte selon 11 catégories, dont PII et jailbreaking[6]. Son modèle frère à poids ouverts, Shieldstral 1.0, lit aussi les images[4].

API de modération vidéo

Amazon Rekognition, Sightengine et Hive proposent la modération vidéo ; les API de modération d'OpenAI, d'Azure Content Safety, de Google et de Mistral de ce comparatif ne documentent que des entrées texte ou image[3][7][11]. Avec une API texte et image, vous pouvez extraire vous-même des images clés et les envoyer comme images, ce qui correspond à la façon dont Hive décrit son propre traitement vidéo[11].

Meilleure API de modération d'images

Pour des politiques image larges avec des étiquettes comme alcool, jeux d'argent ou symboles de haine, Rekognition ou Sightengine[8][7]. Pour le contenu sexuel, la violence et l'automutilation seulement, l'endpoint gratuit d'OpenAI couvre aussi les images[2]. Détails dans le guide de l'API de modération d'images.

API de modération open source

Shieldstral 1.0 de Mistral est publié avec des poids Apache 2.0 et traite texte et images ; il est en préversion publique[4]. Si vous avez plutôt besoin des modèles d'Azure sur votre propre infrastructure, Azure vend Content Safety sous forme de conteneurs déconnectés avec engagement annuel[9].

Choisir la meilleure API de modération de contenu pour votre stack

Partez des médias à contrôler. Les produits texte seul peuvent démarrer avec l'endpoint gratuit d'OpenAI ou Mistral Moderation 2, puis passer à Azure quand ils ont besoin de niveaux de gravité ou de catégories personnalisées. Les produits riches en images ont intérêt à regarder Rekognition ou Sightengine pour la profondeur des étiquettes, et tout ce qui comporte de la vidéo se limite à Rekognition, Sightengine ou Hive. Si le contenu ne doit pas quitter vos serveurs, les poids ouverts de Shieldstral sont la voie réaliste.

Entre les candidats restants, le prix tranche généralement, et le comparatif des prix des API de modération donne les chiffres. Si vous voulez omni-moderation-latest avec le même contrat asynchrone que vos autres modèles reAPI, consultez la page du modèle Content Moderation. Dans tous les cas, la meilleure API de modération de contenu est celle dont les catégories correspondent à la politique que vous appliquez réellement.

Références

  1. OpenAI. Is the Moderation endpoint free to use? Consulté en octobre 2026 sur help.openai.com/en/articles/4936833-is-the-moderation-endpoint-free-to-use
  2. OpenAI. Moderation guide. Consulté en octobre 2026 sur developers.openai.com/api/docs/guides/moderation
  3. Amazon Web Services. Amazon Rekognition pricing. Consulté en octobre 2026 sur aws.amazon.com/rekognition/pricing
  4. Mistral AI. Shieldstral 1.0 model card. Consulté en octobre 2026 sur docs.mistral.ai/models/shieldstral-1-0
  5. Mistral AI. Mistral Moderation 2 model card. Consulté en octobre 2026 sur docs.mistral.ai/models/mistral-moderation-26-03
  6. Mistral AI. Moderation and guardrailing. Consulté en octobre 2026 sur docs.mistral.ai/studio/conversations/moderation
  7. Sightengine. Pricing. Consulté en octobre 2026 sur sightengine.com/pricing
  8. Amazon Web Services. Using the image and video moderation APIs, Amazon Rekognition Developer Guide. Consulté en octobre 2026 sur docs.aws.amazon.com/rekognition/latest/dg/moderation-api.html
  9. Microsoft Azure. Content Safety pricing. Consulté en octobre 2026 sur azure.microsoft.com/en-us/pricing/details/content-safety
  10. Jigsaw. Perspective API sunset announcement. Consulté en octobre 2026 sur perspectiveapi.com
  11. Hive. Pricing. Consulté en octobre 2026 sur thehive.ai/pricing
  12. Microsoft Learn. Harm categories in Azure AI Content Safety. Consulté en octobre 2026 sur learn.microsoft.com/en-us/azure/ai-services/content-safety/concepts/harm-categories
  13. Google Cloud. Moderate text, Cloud Natural Language API. Consulté en octobre 2026 sur docs.cloud.google.com/natural-language/docs/moderating-text
  14. Amazon Web Services. Amazon Comprehend pricing. Consulté en octobre 2026 sur aws.amazon.com/comprehend/pricing
  15. Amazon Web Services. Trust and safety, Amazon Comprehend Developer Guide. Consulté en octobre 2026 sur docs.aws.amazon.com/comprehend/latest/dg/trust-safety.html
  16. Google Cloud. Detect explicit content (SafeSearch). Consulté en octobre 2026 sur docs.cloud.google.com/vision/docs/detecting-safe-search
  17. Google Cloud. Cloud Vision API pricing. Consulté en octobre 2026 sur cloud.google.com/vision/pricing
  18. Google Cloud. Cloud Natural Language pricing. Consulté en octobre 2026 sur cloud.google.com/natural-language/pricing
  19. reAPI. Content Moderation model page. reapi.ai/models/content-moderation
  20. Microsoft Learn. What is Azure AI Content Safety? Consulté en octobre 2026 sur learn.microsoft.com/en-us/azure/ai-services/content-safety/overview
  21. reAPI. Content Moderation API docs. reapi.ai/docs/content-moderation
  22. OpenAI. omni-moderation model page. Consulté en octobre 2026 sur developers.openai.com/api/docs/models/omni-moderation-latest