GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
最好的内容审核 API:文本、图片与视频对比
2026/10/07

最好的内容审核 API:文本、图片与视频对比

按使用场景选出最好的内容审核 API:从模态、类别、计费方式、免费额度和自托管五个维度对比 OpenAI、Azure、AWS、Google、Hive、Sightengine 和 Mistral。

哪个是最好的内容审核 API,与其看准确率宣传,不如看四个朴素的事实:它能读哪些媒体、返回哪些类别、怎么计费、能不能自己部署。OpenAI 的 omni-moderation-latest 免费,能读文本和图片[1][2],但在图片上只评估 13 个类别中的 6 个,也不分类音频[2]。Amazon Rekognition 按分钟审核视频[3]。Mistral 公开了一个多模态审核模型的开放权重[4]。决定选型的往往是这些差异,而不是哪个基准测试。

本文对比 11 个选项,每一项都在 2026 年 10 月对照厂商自己的文档和价格页核实过。内容只涉及各 API 覆盖什么、怎么计费。每项的具体价格和成本测算见 OpenAI Moderation API 免费吗?。

TL;DR

  • 低预算做文本和图片: OpenAI 审核端点,对 OpenAI API 用户免费,13 个类别[1][2]。
  • 需要 PII 与越狱检测的文本: Mistral Moderation 2,标为免费,11 个文本类别[5][6]。
  • 视频: Amazon Rekognition(存储视频与流式视频,按分钟计费)或 Sightengine(付费方案支持视频,Pro 方案支持直播)[3][7]。
  • 细粒度图片标签: Rekognition 的三级分类体系(10 个顶级类别),或 Sightengine 的 120 多个图片类别[8][7]。
  • 自托管: Mistral 的 Shieldstral 1.0(Apache 2.0 权重,公开预览)或 Azure 按承诺方案提供的离线容器[4][9]。
  • 新项目避开: Perspective API,2026 年 12 月 31 日之后停止服务[10]。

内容审核 API 之间的差别在哪里

大多数审核 API 返回的答案形式相同:一组类别,每个类别带一个分数或严重程度。生产环境中真正要紧的差别在别处。

模态。 纯文本 API 帮不了用户上传的照片,图片 API 也不读配文。视频更少见:下面的选项中只有 Amazon Rekognition、Sightengine 和 Hive 列出了视频审核,而且 Hive 需要通过联系表单开通[3][7][11]。

类别设计。 OpenAI 返回 13 个有害类别,形式是布尔值加 0 到 1 的分数[2]。Azure 返回 4 个类别(仇恨、色情、暴力、自残),文本的严重程度为 0 到 7,图片为 0、2、4 或 6[12]。Google Natural Language 返回 16 个属性,其中 Health、Finance、Politics、Legal 等几个更像敏感话题而不是危害[13]。选择与你的审核规则写法相匹配的设计。

计费单位。 各厂商计的是字符、文本记录、请求、图片、分钟或"操作数",单位决定了哪类输入便宜。一条 50 字符的评论在 Hive 是 1 次请求,在 Amazon Comprehend 却按 300 字符计费[11][14]。价格对比解释了每种单位。

在哪里运行。 所有托管 API 都会把用户内容发给第三方。如果这不可接受,候选就只剩能下载权重或容器的选项。

最好的内容审核 API 对比表

API文本图片视频类别计费单位免费用量自托管
OpenAI omni-moderation-latest支持支持(13 个类别中的 6 个)未列出13 个有害类别,分数 0 到 1[2]无(免费)免费,受速率限制[1]否
Azure AI Content Safety支持支持未列出4 个类别,严重程度 0 到 7[12]文本记录(1,000 字符)、图片每月 5,000 条文本记录 + 5,000 张图片[9]离线容器,年度承诺[9]
Amazon Rekognition不支持支持支持三级分类体系,10 个顶级类别[8]图片、视频分钟12 个月内每月 1,000 张图片 + 60 分钟视频[3]否
Amazon Comprehend 毒性检测仅英文不支持未列出7 个标签[15]100 字符,最低 3 个单位不在免费套餐列表中[14]否
Google Cloud Vision SafeSearch不支持支持未列出5 个可能性:adult、spoof、medical、violence、racy[16]图片每月 1,000 个单位[17]否
Google Natural Language Text Moderation支持不支持未列出16 个属性,置信度 0 到 1[13]100 字符每月 50,000 个单位[18]否
Hive支持支持通过联系表单价格页未列出请求;音频按分钟添加付款方式后获得 $50+ 额度[11]否
Sightengine支持支持(120+ 个类别)支持;直播需 Pro120+ 个图片类别[7]操作数每月 2,000 次操作[7]否
Mistral Moderation 2支持不支持未列出11 个,含 PII 和越狱[6]无(免费)标为免费[5]否
Mistral Shieldstral 1.0支持支持未列出自己编写的是/否规则问题[4]自有硬件开放权重是,Apache 2.0
reAPI Content Moderation支持支持(图片 URL)不支持与 omni-moderation-latest 相同的 13 个[19]1,000 词文本或 1 张图片付费否

音频是另一种需求。OpenAI 的模型不分类音频[2];Hive 的音频审核按分钟计费,Sightengine 在 Pro 方案中包含音频审核[11][7]。

按使用场景挑选最好的内容审核 API

聊天、评论和 LLM 提示词

对于聊天应用、评论区或 LLM 流水线中的文本,先从免费选项开始。OpenAI 端点覆盖骚扰、仇恨、违法、自残、色情和暴力几大类及其子类[2],Responses API 还能在同一次调用中返回模型输入和输出的审核分数[2]。Mistral Moderation 2 增加了 OpenAI 没有的类别:PII、越狱,以及索取个性化医疗、金融或法律建议的请求[6]。如果你担心提示词注入或用户套取个人信息,这份类别清单更合适。

如果你想要分级的严重程度而不是概率,或者需要自定义类别(预览中),选 Azure[12][20]。Azure 的 Content Safety 模型在 8 种语言上训练和测试过,其他语言也能用,但质量可能不稳定[20]。Amazon Comprehend 的毒性检测只支持英文[15]。

用户上传的图片

通用模型在图片上覆盖较薄。OpenAI 对图片只应用自残、色情和暴力几类;骚扰、仇恨和违法只针对文本[2]。Azure 的 4 个类别也都适用于图片[12]。

如果你的规则里写着泳装、酒精、赌博、毒品、粗鲁手势或仇恨符号,就用图片专用服务。Rekognition 把这些都列为顶级类别[8],Sightengine 列出了 120 多个图片类别[7]。图片输入、阈值和代码的细节见我们的图片审核 API 指南。

视频和直播

Rekognition 分析 Amazon S3 中的存储视频和流式视频事件,按处理的分钟数计费[3]。Sightengine 的 Starter 方案支持最大 50 MB 的视频文件,Pro 方案支持最大 500 MB 并支持直播[7]。Hive 在你通过联系表单开通视频后,按你设定的采样频率抽帧[11]。

数据不能离开自有基础设施

Mistral 的 Shieldstral 1.0 是一个 38 亿参数、以 Apache 2.0 发布的模型,按自然语言编写的规则问题对文本和图片输入做分类,上下文为 32k token。目前处于公开预览[4]。Azure 以离线容器形式出售 Content Safety,年度承诺档位以数亿条记录为单位[9],更适合大企业而不是小团队。

已经在用 Perspective API

Jigsaw 正在下线 Perspective。服务运行到 2026 年 12 月 31 日,新的用量和配额申请只受理到 2026 年 2 月,且不提供迁移支持[10]。现在就该规划迁移。如果需要毒性类属性,Google Natural Language Text Moderation 的 16 个属性中包含 Toxic、Insult 和 Profanity[13]。

在 reAPI 上把审核和生成放在一起

如果你已经通过 reAPI 生成图片、视频或文本,Content Moderation 会用同一个 key、同一份额度余额和同一套任务契约运行 omni-moderation-latest。它是异步的:提交到 /api/v1/moderations,再轮询任务[21]。这与 OpenAI 的同步响应不同,因此不能直接替换基于 OpenAI SDK 的集成。按审核单位计费,当前费率见模型页[19]。

OpenAI Moderation API 够用吗?

这个问题直接来自开发者论坛,答案是"对很多文本场景来说够用"。它免费,覆盖 13 个类别,支持批量提交字符串[1][2]。它的限制都有文档记载,可以拿来对照你的场景:

  • 7 个类别不看图片,所以以图片为主的平台只能得到部分覆盖[2]。
  • 不分类音频,OpenAI 只记载了文本和图片输入[2]。
  • OpenAI 会持续升级模型,基于 category_scores 的阈值 "may need recalibration"[2]。
  • 它不是为 CSAM 检测设计的;OpenAI 要求不要发送此类内容[2]。
  • 吞吐量受使用等级限制,Free 等级为每天 5,000 次请求起[22]。

如果以上都不构成障碍,它就是默认选择。如果有一条构成障碍,上面的表格能告诉你哪个 API 可以补上。

常见问题

OpenAI Moderation API 够用吗?

对于其 13 个类别范围内的文本审核,通常够用,而且不花钱[1]。如果你需要音频或视频、自残/色情/暴力以外的图片检查,或者 PII、越狱这类类别,它就不够了[2][6]。

Azure 内容审核 API

Azure 现在的产品是 Azure AI Content Safety,提供独立的 Analyze Text 和 Analyze Image 两个 API,按严重程度对仇恨、色情、暴力和自残打分[20][12]。另外还有 Prompt Shields、受保护材料检测和自定义类别[20]。免费层每月含 5,000 条文本记录和 5,000 张图片[9]。

Google 内容审核 API

Google 把审核拆成两个 API:图片用 Cloud Vision SafeSearch,5 个可能性类别[16];文本用 Cloud Natural Language Text Moderation,16 个属性[13]。两者都有每月免费额度[17][18]。

Amazon Rekognition 内容审核 API

Rekognition 通过 DetectModerationLabels 审核图片,也能审核存储视频和流式视频[3]。标签采用三级分类体系,顶级类别共 10 个,从 Explicit、Violence 到 Gambling、Hate Symbols[8]。在 AWS 上审核文本,则是另一个只支持英文的选项:Amazon Comprehend 毒性检测[15]。

Mistral 审核 API

Mistral 在 /v1/moderations 上提供 mistral-moderation-2603(Mistral Moderation 2),上下文 128k,标价为免费[5]。它把文本分为 11 个类别,包括 PII 和越狱[6]。它的开放权重兄弟模型 Shieldstral 1.0 还能读图片[4]。

视频审核 API

列出视频审核的有 Amazon Rekognition、Sightengine 和 Hive;本文中 OpenAI、Azure Content Safety、Google 和 Mistral 的审核 API 只记载了文本或图片输入[3][7][11]。使用文本加图片的 API 时,你可以自己抽帧再作为图片提交,Hive 描述的自家视频处理方式也是如此[11]。

最好的图片审核 API

如果图片规则很宽,包含酒精、赌博、仇恨符号这类标签,选 Rekognition 或 Sightengine[8][7]。如果只关心色情、暴力和自残,OpenAI 的免费端点也覆盖图片[2]。详见图片审核 API 指南。

开源审核 API

Mistral 的 Shieldstral 1.0 以 Apache 2.0 权重发布,能处理文本和图片,目前处于公开预览[4]。如果你需要在自己的基础设施上跑 Azure 的模型,Azure 以年度承诺的离线容器形式出售 Content Safety[9]。

为你的技术栈选择最好的内容审核 API

从需要检查的媒体出发。纯文本产品可以先用 OpenAI 免费端点或 Mistral Moderation 2,等需要严重程度分级或自定义类别时再换 Azure。以图片为主的产品应看 Rekognition 或 Sightengine 的标签深度,涉及视频的则只剩 Rekognition、Sightengine 和 Hive。如果内容不能离开你的服务器,Shieldstral 的开放权重是现实的路径。

剩下的候选之间通常由价格决定,具体数字见审核 API 价格对比。如果你希望 omni-moderation-latest 与其他 reAPI 模型使用同一套异步契约,请看 Content Moderation 模型页。无论如何,最好的内容审核 API 是类别与你实际执行的审核规则相匹配的那一个。

参考资料

  1. OpenAI. Is the Moderation endpoint free to use? 2026 年 10 月检索自 help.openai.com/en/articles/4936833-is-the-moderation-endpoint-free-to-use
  2. OpenAI. Moderation guide. 2026 年 10 月检索自 developers.openai.com/api/docs/guides/moderation
  3. Amazon Web Services. Amazon Rekognition pricing. 2026 年 10 月检索自 aws.amazon.com/rekognition/pricing
  4. Mistral AI. Shieldstral 1.0 model card. 2026 年 10 月检索自 docs.mistral.ai/models/shieldstral-1-0
  5. Mistral AI. Mistral Moderation 2 model card. 2026 年 10 月检索自 docs.mistral.ai/models/mistral-moderation-26-03
  6. Mistral AI. Moderation and guardrailing. 2026 年 10 月检索自 docs.mistral.ai/studio/conversations/moderation
  7. Sightengine. Pricing. 2026 年 10 月检索自 sightengine.com/pricing
  8. Amazon Web Services. Using the image and video moderation APIs, Amazon Rekognition Developer Guide. 2026 年 10 月检索自 docs.aws.amazon.com/rekognition/latest/dg/moderation-api.html
  9. Microsoft Azure. Content Safety pricing. 2026 年 10 月检索自 azure.microsoft.com/en-us/pricing/details/content-safety
  10. Jigsaw. Perspective API sunset announcement. 2026 年 10 月检索自 perspectiveapi.com
  11. Hive. Pricing. 2026 年 10 月检索自 thehive.ai/pricing
  12. Microsoft Learn. Harm categories in Azure AI Content Safety. 2026 年 10 月检索自 learn.microsoft.com/en-us/azure/ai-services/content-safety/concepts/harm-categories
  13. Google Cloud. Moderate text, Cloud Natural Language API. 2026 年 10 月检索自 docs.cloud.google.com/natural-language/docs/moderating-text
  14. Amazon Web Services. Amazon Comprehend pricing. 2026 年 10 月检索自 aws.amazon.com/comprehend/pricing
  15. Amazon Web Services. Trust and safety, Amazon Comprehend Developer Guide. 2026 年 10 月检索自 docs.aws.amazon.com/comprehend/latest/dg/trust-safety.html
  16. Google Cloud. Detect explicit content (SafeSearch). 2026 年 10 月检索自 docs.cloud.google.com/vision/docs/detecting-safe-search
  17. Google Cloud. Cloud Vision API pricing. 2026 年 10 月检索自 cloud.google.com/vision/pricing
  18. Google Cloud. Cloud Natural Language pricing. 2026 年 10 月检索自 cloud.google.com/natural-language/pricing
  19. reAPI. Content Moderation model page. reapi.ai/models/content-moderation
  20. Microsoft Learn. What is Azure AI Content Safety? 2026 年 10 月检索自 learn.microsoft.com/en-us/azure/ai-services/content-safety/overview
  21. reAPI. Content Moderation API docs. reapi.ai/docs/content-moderation
  22. OpenAI. omni-moderation model page. 2026 年 10 月检索自 developers.openai.com/api/docs/models/omni-moderation-latest