GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
La mejor API de moderación de contenido: texto, imagen y vídeo
2026/10/07

La mejor API de moderación de contenido: texto, imagen y vídeo

La mejor API de moderación de contenido según el caso de uso: OpenAI, Azure, AWS, Google, Hive, Sightengine y Mistral por modalidad, categorías, facturación y autoalojamiento.

La mejor API de moderación de contenido depende menos de las promesas de precisión que de cuatro hechos concretos: qué medios lee, qué categorías devuelve, cómo factura y si puedes ejecutarla tú mismo. omni-moderation-latest de OpenAI es gratis y lee texto e imágenes[1][2], pero solo puntúa 6 de sus 13 categorías en imágenes y no clasifica audio[2]. Amazon Rekognition modera vídeo y factura por minuto[3]. Mistral publica pesos abiertos de un modelo de moderación multimodal[4]. Esas diferencias deciden la elección más a menudo que cualquier benchmark.

Esta comparativa cubre once opciones, cada una verificada en octubre de 2026 con la documentación y las páginas de precios del propio proveedor. Se centra en qué cubre cada API y cómo factura. Para los precios por elemento y un ejemplo de coste, consulta ¿Es gratis la API de moderación de OpenAI?.

TL;DR

  • Texto e imágenes con poco presupuesto: el endpoint de moderación de OpenAI, gratis para usuarios de la API de OpenAI, 13 categorías[1][2].
  • Texto con detección de PII y jailbreak: Mistral Moderation 2, que figura como gratis, 11 categorías de texto[5][6].
  • Vídeo: Amazon Rekognition (vídeo almacenado y en streaming, facturado por minuto) o Sightengine (vídeo en planes de pago, emisiones en directo en Pro)[3][7].
  • Etiquetas de imagen detalladas: la taxonomía de tres niveles de Rekognition con 10 categorías principales o las más de 120 clases de imagen de Sightengine[8][7].
  • Autoalojamiento: Shieldstral 1.0 de Mistral (pesos Apache 2.0, vista previa pública) o los contenedores desconectados de Azure con plan de compromiso[4][9].
  • Evitar en proyectos nuevos: Perspective API, que deja de funcionar después del 31 de diciembre de 2026[10].

Qué diferencia a una API de moderación de contenido de otra

La mayoría de las APIs de moderación devuelven el mismo tipo de respuesta: un conjunto de categorías con una puntuación o gravedad cada una. Las diferencias que importan en producción están en otro sitio.

Modalidad. Las APIs solo de texto no ayudan con fotos subidas, y las APIs de imagen no leen los pies de foto. El vídeo es todavía menos común: de las opciones siguientes, solo Amazon Rekognition, Sightengine y Hive ofrecen moderación de vídeo, y Hive la activa mediante un formulario de contacto[3][7][11].

Diseño de categorías. OpenAI devuelve 13 categorías de daño como booleanos más puntuaciones de 0 a 1[2]. Azure devuelve cuatro categorías (odio, sexual, violencia, autolesión) con un nivel de gravedad de 0 a 7 para texto y de 0, 2, 4 o 6 para imágenes[12]. Google Natural Language devuelve 16 atributos, varios de ellos temas sensibles más que daños, como Health, Finance, Politics y Legal[13]. Elige el diseño que encaje con cómo está escrita tu política.

Unidad de facturación. Los proveedores cuentan caracteres, registros de texto, solicitudes, imágenes, minutos u "operaciones", y la unidad cambia qué entradas salen baratas. Un comentario de 50 caracteres es una solicitud en Hive, pero se factura como 300 caracteres en Amazon Comprehend[11][14]. La comparativa de precios explica cada unidad.

Dónde se ejecuta. Toda API alojada envía el contenido de tus usuarios a un tercero. Si eso no es aceptable, la lista se reduce a las opciones con pesos o contenedores descargables.

Tabla comparativa de la mejor API de moderación de contenido

APITextoImagenVídeoCategoríasUnidad de facturaciónUso gratuitoAutoalojamiento
OpenAI omni-moderation-latestSíSí (6 de 13 categorías)No indicado13 categorías de daño, puntuación de 0 a 1[2]Ninguna (gratis)Gratis, dentro de los rate limits[1]No
Azure AI Content SafetySíSíNo indicado4 categorías, gravedad de 0 a 7[12]Registro de texto (1.000 caracteres), imagen5.000 registros de texto + 5.000 imágenes al mes[9]Contenedores desconectados, compromiso anual[9]
Amazon RekognitionNoSíSíTaxonomía de 3 niveles, 10 principales[8]Imagen, minuto de vídeo1.000 imágenes + 60 minutos de vídeo al mes durante 12 meses[3]No
Amazon Comprehend toxicidadSolo inglésNoNo indicado7 etiquetas[15]100 caracteres, mínimo 3 unidadesNo está en la lista del nivel gratuito[14]No
Google Cloud Vision SafeSearchNoSíNo indicado5 probabilidades: adult, spoof, medical, violence, racy[16]Imagen1.000 unidades al mes[17]No
Google Natural Language Text ModerationSíNoNo indicado16 atributos, confianza de 0 a 1[13]100 caracteres50.000 unidades al mes[18]No
HiveSíSíMediante formulario de contactoNo figura en la página de preciosSolicitud; audio por minuto$50+ en créditos tras añadir un método de pago[11]No
SightengineSíSí (más de 120 clases)Sí; directos en ProMás de 120 clases de imagen[7]Operación2.000 operaciones al mes[7]No
Mistral Moderation 2SíNoNo indicado11, incl. PII y jailbreaking[6]Ninguna (gratis)Figura como gratis[5]No
Mistral Shieldstral 1.0SíSíNo indicadoTus propias preguntas de política sí/no[4]Tu hardwarePesos abiertosSí, Apache 2.0
reAPI Content ModerationSíSí (URLs de imagen)NoLas mismas 13 que omni-moderation-latest[19]1.000 palabras de texto o 1 imagenDe pagoNo

El audio es una necesidad aparte. El modelo de OpenAI no lo clasifica[2]; Hive cobra la moderación de audio por minuto y Sightengine la incluye en el plan Pro[11][7].

Cómo elegir la mejor API de moderación de contenido según el caso de uso

Chat, comentarios y prompts de LLM

Para texto en una app de chat, una sección de comentarios o un pipeline de LLM, empieza por una opción gratuita. El endpoint de OpenAI cubre las familias de acoso, odio, actividades ilícitas, autolesión, contenido sexual y violencia con subcategorías[2], y la Responses API puede devolver puntuaciones de moderación para la entrada y la salida de un modelo en la misma llamada[2]. Mistral Moderation 2 añade categorías que OpenAI no tiene: PII, jailbreaking y peticiones de asesoramiento personalizado de salud, financiero o legal[6]. Si te preocupa la inyección de prompts o los usuarios que intentan sonsacar datos personales, esa lista encaja mejor.

Elige Azure cuando quieras niveles de gravedad en lugar de una probabilidad, o necesites definir categorías personalizadas (en vista previa)[12][20]. Los modelos de Content Safety de Azure están entrenados y probados en ocho idiomas y pueden funcionar en otros con calidad variable[20]. La detección de toxicidad de Amazon Comprehend solo admite inglés[15].

Imágenes subidas por usuarios

Los modelos de uso general se quedan más cortos con imágenes. OpenAI aplica a una imagen solo las familias de autolesión, contenido sexual y violencia; acoso, odio y actividades ilícitas son solo de texto[2]. Azure aplica sus cuatro categorías también a imágenes[12].

Cuando tu política menciona cosas como bañadores, alcohol, juegos de azar, drogas, gestos groseros o símbolos de odio, usa un especialista en imagen. Rekognition las tiene como categorías principales[8], y Sightengine enumera más de 120 clases de imagen[7]. Nuestra guía de la API de moderación de imágenes profundiza en entradas de imagen, umbrales y código.

Vídeo y emisiones en directo

Rekognition analiza vídeo almacenado en Amazon S3 y eventos de vídeo en streaming, facturados por minuto procesado[3]. Sightengine procesa archivos de vídeo de hasta 50 MB en Starter y de hasta 500 MB más directos en Pro[7]. Hive extrae fotogramas con la frecuencia de muestreo que tú fijes, después de activar el vídeo mediante su formulario de contacto[11].

Datos que no pueden salir de tu infraestructura

Shieldstral 1.0 de Mistral es un modelo de 3.800 millones de parámetros publicado bajo Apache 2.0 que clasifica entradas de texto e imagen según preguntas de política en lenguaje natural, con un contexto de 32k tokens. Está en vista previa pública[4]. Azure vende Content Safety como contenedores desconectados con niveles de compromiso anual dimensionados en cientos de millones de registros[9], algo pensado para grandes empresas más que para equipos pequeños.

Si ya usas Perspective API

Jigsaw va a retirar Perspective. El servicio sigue activo hasta el 31 de diciembre de 2026, las nuevas solicitudes de uso y de cuota solo se aceptaron hasta febrero de 2026 y no hay soporte de migración[10]. Planifica el cambio ya. Si buscas atributos de tipo toxicidad, Google Natural Language Text Moderation devuelve Toxic, Insult y Profanity entre sus 16[13].

Moderación junto a la generación en reAPI

Si ya generas imágenes, vídeo o texto con reAPI, Content Moderation ejecuta omni-moderation-latest con la misma clave, el mismo saldo de créditos y el mismo contrato de tareas. Es asíncrono: envías a /api/v1/moderations y luego consultas la tarea[21]. Eso difiere de la respuesta síncrona de OpenAI, así que no sustituye directamente a las integraciones con el SDK de OpenAI. Se factura por unidad de moderación; la tarifa actual está en la página del modelo[19].

¿Es suficiente la API de moderación de OpenAI?

La pregunta sale directamente de foros de desarrolladores, y la respuesta es "para muchas cargas de texto, sí". Es gratis, cubre 13 categorías y acepta lotes de strings[1][2]. Sus límites están documentados, así que puedes contrastarlos con tu caso:

  • Siete categorías ignoran las imágenes, de modo que una plataforma con muchas imágenes obtiene una cobertura parcial[2].
  • No clasifica audio, y OpenAI solo documenta entrada de texto e imagen[2].
  • OpenAI actualiza el modelo con el tiempo, y los umbrales basados en category_scores "may need recalibration"[2].
  • No está diseñada para detectar CSAM; OpenAI pide no enviarle ese material[2].
  • El rendimiento está limitado por nivel de uso, empezando por 5.000 solicitudes al día en el nivel Free[22].

Si ninguno de esos puntos la descarta, es la opción por defecto. Si alguno lo hace, la tabla de arriba muestra qué API cubre el hueco.

Preguntas frecuentes

¿Es suficiente la API de moderación de OpenAI?

Para moderar texto dentro de sus 13 categorías, a menudo sí, y no cuesta nada[1]. Se queda corta si necesitas audio o vídeo, revisión de imágenes más allá de las familias de autolesión, contenido sexual y violencia, o categorías como PII y jailbreaking[2][6].

API de moderación de contenido de Azure

El producto actual de Azure es Azure AI Content Safety, con APIs separadas Analyze Text y Analyze Image que puntúan odio, contenido sexual, violencia y autolesión con niveles de gravedad[20][12]. También ofrece Prompt Shields, detección de material protegido y categorías personalizadas[20]. El nivel gratuito cubre 5.000 registros de texto y 5.000 imágenes al mes[9].

API de moderación de contenido de Google

Google reparte la moderación en dos APIs: Cloud Vision SafeSearch para imágenes, con cinco categorías de probabilidad[16], y Cloud Natural Language Text Moderation para texto, con 16 atributos[13]. Ambas tienen cuotas mensuales gratuitas[17][18].

API de moderación de contenido de Amazon Rekognition

Rekognition modera imágenes mediante DetectModerationLabels y también modera vídeo almacenado y en streaming[3]. Las etiquetas siguen una taxonomía de tres niveles con 10 categorías principales, de Explicit y Violence a Gambling y Hate Symbols[8]. Para texto en AWS, la detección de toxicidad de Amazon Comprehend es la opción aparte, solo en inglés[15].

API de moderación de Mistral

Mistral ofrece mistral-moderation-2603 (Mistral Moderation 2) en /v1/moderations, con un contexto de 128k y precio publicado gratuito[5]. Clasifica texto en 11 categorías, entre ellas PII y jailbreaking[6]. Su modelo hermano de pesos abiertos, Shieldstral 1.0, también lee imágenes[4].

API de moderación de vídeo

Amazon Rekognition, Sightengine y Hive ofrecen moderación de vídeo; las APIs de moderación de OpenAI, Azure Content Safety, Google y Mistral de esta comparativa solo documentan entrada de texto o imagen[3][7][11]. Con una API de texto e imagen puedes extraer fotogramas tú mismo y enviarlos como imágenes, que es como Hive describe su propio procesamiento de vídeo[11].

La mejor API de moderación de imágenes

Para políticas de imagen amplias con etiquetas como alcohol, juegos de azar o símbolos de odio, Rekognition o Sightengine[8][7]. Si solo te interesan contenido sexual, violencia y autolesión, el endpoint gratuito de OpenAI también cubre imágenes[2]. Más detalles en la guía de la API de moderación de imágenes.

API de moderación de código abierto

Shieldstral 1.0 de Mistral se publica con pesos Apache 2.0 y procesa texto e imágenes; está en vista previa pública[4]. Si en cambio necesitas los modelos de Azure en tu propia infraestructura, Azure vende Content Safety como contenedores desconectados con niveles de compromiso anual[9].

Cómo elegir la mejor API de moderación de contenido para tu stack

Empieza por los medios que tienes que revisar. Los productos solo de texto pueden arrancar con el endpoint gratuito de OpenAI o con Mistral Moderation 2 y pasar a Azure cuando necesiten niveles de gravedad o categorías personalizadas. Los productos con muchas imágenes deberían mirar Rekognition o Sightengine por la profundidad de sus etiquetas, y cualquier cosa con vídeo se reduce a Rekognition, Sightengine o Hive. Si el contenido no puede salir de tus servidores, los pesos abiertos de Shieldstral son la vía realista.

Entre las opciones que quedan suele decidir el precio, y la comparativa de precios de las APIs de moderación tiene las cifras. Si quieres omni-moderation-latest con el mismo contrato asíncrono que tus otros modelos de reAPI, consulta la página del modelo Content Moderation. En cualquier caso, la mejor API de moderación de contenido es aquella cuyas categorías coinciden con la política que realmente aplicas.

Referencias

  1. OpenAI. Is the Moderation endpoint free to use? Consultado en octubre de 2026 en help.openai.com/en/articles/4936833-is-the-moderation-endpoint-free-to-use
  2. OpenAI. Moderation guide. Consultado en octubre de 2026 en developers.openai.com/api/docs/guides/moderation
  3. Amazon Web Services. Amazon Rekognition pricing. Consultado en octubre de 2026 en aws.amazon.com/rekognition/pricing
  4. Mistral AI. Shieldstral 1.0 model card. Consultado en octubre de 2026 en docs.mistral.ai/models/shieldstral-1-0
  5. Mistral AI. Mistral Moderation 2 model card. Consultado en octubre de 2026 en docs.mistral.ai/models/mistral-moderation-26-03
  6. Mistral AI. Moderation and guardrailing. Consultado en octubre de 2026 en docs.mistral.ai/studio/conversations/moderation
  7. Sightengine. Pricing. Consultado en octubre de 2026 en sightengine.com/pricing
  8. Amazon Web Services. Using the image and video moderation APIs, Amazon Rekognition Developer Guide. Consultado en octubre de 2026 en docs.aws.amazon.com/rekognition/latest/dg/moderation-api.html
  9. Microsoft Azure. Content Safety pricing. Consultado en octubre de 2026 en azure.microsoft.com/en-us/pricing/details/content-safety
  10. Jigsaw. Perspective API sunset announcement. Consultado en octubre de 2026 en perspectiveapi.com
  11. Hive. Pricing. Consultado en octubre de 2026 en thehive.ai/pricing
  12. Microsoft Learn. Harm categories in Azure AI Content Safety. Consultado en octubre de 2026 en learn.microsoft.com/en-us/azure/ai-services/content-safety/concepts/harm-categories
  13. Google Cloud. Moderate text, Cloud Natural Language API. Consultado en octubre de 2026 en docs.cloud.google.com/natural-language/docs/moderating-text
  14. Amazon Web Services. Amazon Comprehend pricing. Consultado en octubre de 2026 en aws.amazon.com/comprehend/pricing
  15. Amazon Web Services. Trust and safety, Amazon Comprehend Developer Guide. Consultado en octubre de 2026 en docs.aws.amazon.com/comprehend/latest/dg/trust-safety.html
  16. Google Cloud. Detect explicit content (SafeSearch). Consultado en octubre de 2026 en docs.cloud.google.com/vision/docs/detecting-safe-search
  17. Google Cloud. Cloud Vision API pricing. Consultado en octubre de 2026 en cloud.google.com/vision/pricing
  18. Google Cloud. Cloud Natural Language pricing. Consultado en octubre de 2026 en cloud.google.com/natural-language/pricing
  19. reAPI. Content Moderation model page. reapi.ai/models/content-moderation
  20. Microsoft Learn. What is Azure AI Content Safety? Consultado en octubre de 2026 en learn.microsoft.com/en-us/azure/ai-services/content-safety/overview
  21. reAPI. Content Moderation API docs. reapi.ai/docs/content-moderation
  22. OpenAI. omni-moderation model page. Consultado en octubre de 2026 en developers.openai.com/api/docs/models/omni-moderation-latest