
最好的内容审核 API:文本、图片与视频对比
按使用场景选出最好的内容审核 API:从模态、类别、计费方式、免费额度和自托管五个维度对比 OpenAI、Azure、AWS、Google、Hive、Sightengine 和 Mistral。
哪个是最好的内容审核 API,与其看准确率宣传,不如看四个朴素的事实:它能读哪些媒体、返回哪些类别、怎么计费、能不能自己部署。OpenAI 的 omni-moderation-latest 免费,能读文本和图片[1][2],但在图片上只评估 13 个类别中的 6 个,也不分类音频[2]。Amazon Rekognition 按分钟审核视频[3]。Mistral 公开了一个多模态审核模型的开放权重[4]。决定选型的往往是这些差异,而不是哪个基准测试。
本文对比 11 个选项,每一项都在 2026 年 10 月对照厂商自己的文档和价格页核实过。内容只涉及各 API 覆盖什么、怎么计费。每项的具体价格和成本测算见 OpenAI Moderation API 免费吗?。
TL;DR
- 低预算做文本和图片: OpenAI 审核端点,对 OpenAI API 用户免费,13 个类别[1][2]。
- 需要 PII 与越狱检测的文本: Mistral Moderation 2,标为免费,11 个文本类别[5][6]。
- 视频: Amazon Rekognition(存储视频与流式视频,按分钟计费)或 Sightengine(付费方案支持视频,Pro 方案支持直播)[3][7]。
- 细粒度图片标签: Rekognition 的三级分类体系(10 个顶级类别),或 Sightengine 的 120 多个图片类别[8][7]。
- 自托管: Mistral 的 Shieldstral 1.0(Apache 2.0 权重,公开预览)或 Azure 按承诺方案提供的离线容器[4][9]。
- 新项目避开: Perspective API,2026 年 12 月 31 日之后停止服务[10]。
内容审核 API 之间的差别在哪里
大多数审核 API 返回的答案形式相同:一组类别,每个类别带一个分数或严重程度。生产环境中真正要紧的差别在别处。
模态。 纯文本 API 帮不了用户上传的照片,图片 API 也不读配文。视频更少见:下面的选项中只有 Amazon Rekognition、Sightengine 和 Hive 列出了视频审核,而且 Hive 需要通过联系表单开通[3][7][11]。
类别设计。 OpenAI 返回 13 个有害类别,形式是布尔值加 0 到 1 的分数[2]。Azure 返回 4 个类别(仇恨、色情、暴力、自残),文本的严重程度为 0 到 7,图片为 0、2、4 或 6[12]。Google Natural Language 返回 16 个属性,其中 Health、Finance、Politics、Legal 等几个更像敏感话题而不是危害[13]。选择与你的审核规则写法相匹配的设计。
计费单位。 各厂商计的是字符、文本记录、请求、图片、分钟或"操作数",单位决定了哪类输入便宜。一条 50 字符的评论在 Hive 是 1 次请求,在 Amazon Comprehend 却按 300 字符计费[11][14]。价格对比解释了每种单位。
在哪里运行。 所有托管 API 都会把用户内容发给第三方。如果这不可接受,候选就只剩能下载权重或容器的选项。
最好的内容审核 API 对比表
| API | 文本 | 图片 | 视频 | 类别 | 计费单位 | 免费用量 | 自托管 |
|---|---|---|---|---|---|---|---|
OpenAI omni-moderation-latest | 支持 | 支持(13 个类别中的 6 个) | 未列出 | 13 个有害类别,分数 0 到 1[2] | 无(免费) | 免费,受速率限制[1] | 否 |
| Azure AI Content Safety | 支持 | 支持 | 未列出 | 4 个类别,严重程度 0 到 7[12] | 文本记录(1,000 字符)、图片 | 每月 5,000 条文本记录 + 5,000 张图片[9] | 离线容器,年度承诺[9] |
| Amazon Rekognition | 不支持 | 支持 | 支持 | 三级分类体系,10 个顶级类别[8] | 图片、视频分钟 | 12 个月内每月 1,000 张图片 + 60 分钟视频[3] | 否 |
| Amazon Comprehend 毒性检测 | 仅英文 | 不支持 | 未列出 | 7 个标签[15] | 100 字符,最低 3 个单位 | 不在免费套餐列表中[14] | 否 |
| Google Cloud Vision SafeSearch | 不支持 | 支持 | 未列出 | 5 个可能性:adult、spoof、medical、violence、racy[16] | 图片 | 每月 1,000 个单位[17] | 否 |
| Google Natural Language Text Moderation | 支持 | 不支持 | 未列出 | 16 个属性,置信度 0 到 1[13] | 100 字符 | 每月 50,000 个单位[18] | 否 |
| Hive | 支持 | 支持 | 通过联系表单 | 价格页未列出 | 请求;音频按分钟 | 添加付款方式后获得 $50+ 额度[11] | 否 |
| Sightengine | 支持 | 支持(120+ 个类别) | 支持;直播需 Pro | 120+ 个图片类别[7] | 操作数 | 每月 2,000 次操作[7] | 否 |
| Mistral Moderation 2 | 支持 | 不支持 | 未列出 | 11 个,含 PII 和越狱[6] | 无(免费) | 标为免费[5] | 否 |
| Mistral Shieldstral 1.0 | 支持 | 支持 | 未列出 | 自己编写的是/否规则问题[4] | 自有硬件 | 开放权重 | 是,Apache 2.0 |
| reAPI Content Moderation | 支持 | 支持(图片 URL) | 不支持 | 与 omni-moderation-latest 相同的 13 个[19] | 1,000 词文本或 1 张图片 | 付费 | 否 |
音频是另一种需求。OpenAI 的模型不分类音频[2];Hive 的音频审核按分钟计费,Sightengine 在 Pro 方案中包含音频审核[11][7]。
按使用场景挑选最好的内容审核 API
聊天、评论和 LLM 提示词
对于聊天应用、评论区或 LLM 流水线中的文本,先从免费选项开始。OpenAI 端点覆盖骚扰、仇恨、违法、自残、色情和暴力几大类及其子类[2],Responses API 还能在同一次调用中返回模型输入和输出的审核分数[2]。Mistral Moderation 2 增加了 OpenAI 没有的类别:PII、越狱,以及索取个性化医疗、金融或法律建议的请求[6]。如果你担心提示词注入或用户套取个人信息,这份类别清单更合适。
如果你想要分级的严重程度而不是概率,或者需要自定义类别(预览中),选 Azure[12][20]。Azure 的 Content Safety 模型在 8 种语言上训练和测试过,其他语言也能用,但质量可能不稳定[20]。Amazon Comprehend 的毒性检测只支持英文[15]。
用户上传的图片
通用模型在图片上覆盖较薄。OpenAI 对图片只应用自残、色情和暴力几类;骚扰、仇恨和违法只针对文本[2]。Azure 的 4 个类别也都适用于图片[12]。
如果你的规则里写着泳装、酒精、赌博、毒品、粗鲁手势或仇恨符号,就用图片专用服务。Rekognition 把这些都列为顶级类别[8],Sightengine 列出了 120 多个图片类别[7]。图片输入、阈值和代码的细节见我们的图片审核 API 指南。
视频和直播
Rekognition 分析 Amazon S3 中的存储视频和流式视频事件,按处理的分钟数计费[3]。Sightengine 的 Starter 方案支持最大 50 MB 的视频文件,Pro 方案支持最大 500 MB 并支持直播[7]。Hive 在你通过联系表单开通视频后,按你设定的采样频率抽帧[11]。
数据不能离开自有基础设施
Mistral 的 Shieldstral 1.0 是一个 38 亿参数、以 Apache 2.0 发布的模型,按自然语言编写的规则问题对文本和图片输入做分类,上下文为 32k token。目前处于公开预览[4]。Azure 以离线容器形式出售 Content Safety,年度承诺档位以数亿条记录为单位[9],更适合大企业而不是小团队。
已经在用 Perspective API
Jigsaw 正在下线 Perspective。服务运行到 2026 年 12 月 31 日,新的用量和配额申请只受理到 2026 年 2 月,且不提供迁移支持[10]。现在就该规划迁移。如果需要毒性类属性,Google Natural Language Text Moderation 的 16 个属性中包含 Toxic、Insult 和 Profanity[13]。
在 reAPI 上把审核和生成放在一起
如果你已经通过 reAPI 生成图片、视频或文本,Content Moderation 会用同一个 key、同一份额度余额和同一套任务契约运行 omni-moderation-latest。它是异步的:提交到 /api/v1/moderations,再轮询任务[21]。这与 OpenAI 的同步响应不同,因此不能直接替换基于 OpenAI SDK 的集成。按审核单位计费,当前费率见模型页[19]。
OpenAI Moderation API 够用吗?
这个问题直接来自开发者论坛,答案是"对很多文本场景来说够用"。它免费,覆盖 13 个类别,支持批量提交字符串[1][2]。它的限制都有文档记载,可以拿来对照你的场景:
- 7 个类别不看图片,所以以图片为主的平台只能得到部分覆盖[2]。
- 不分类音频,OpenAI 只记载了文本和图片输入[2]。
- OpenAI 会持续升级模型,基于
category_scores的阈值 "may need recalibration"[2]。 - 它不是为 CSAM 检测设计的;OpenAI 要求不要发送此类内容[2]。
- 吞吐量受使用等级限制,Free 等级为每天 5,000 次请求起[22]。
如果以上都不构成障碍,它就是默认选择。如果有一条构成障碍,上面的表格能告诉你哪个 API 可以补上。
常见问题
OpenAI Moderation API 够用吗?
对于其 13 个类别范围内的文本审核,通常够用,而且不花钱[1]。如果你需要音频或视频、自残/色情/暴力以外的图片检查,或者 PII、越狱这类类别,它就不够了[2][6]。
Azure 内容审核 API
Azure 现在的产品是 Azure AI Content Safety,提供独立的 Analyze Text 和 Analyze Image 两个 API,按严重程度对仇恨、色情、暴力和自残打分[20][12]。另外还有 Prompt Shields、受保护材料检测和自定义类别[20]。免费层每月含 5,000 条文本记录和 5,000 张图片[9]。
Google 内容审核 API
Google 把审核拆成两个 API:图片用 Cloud Vision SafeSearch,5 个可能性类别[16];文本用 Cloud Natural Language Text Moderation,16 个属性[13]。两者都有每月免费额度[17][18]。
Amazon Rekognition 内容审核 API
Rekognition 通过 DetectModerationLabels 审核图片,也能审核存储视频和流式视频[3]。标签采用三级分类体系,顶级类别共 10 个,从 Explicit、Violence 到 Gambling、Hate Symbols[8]。在 AWS 上审核文本,则是另一个只支持英文的选项:Amazon Comprehend 毒性检测[15]。
Mistral 审核 API
Mistral 在 /v1/moderations 上提供 mistral-moderation-2603(Mistral Moderation 2),上下文 128k,标价为免费[5]。它把文本分为 11 个类别,包括 PII 和越狱[6]。它的开放权重兄弟模型 Shieldstral 1.0 还能读图片[4]。
视频审核 API
列出视频审核的有 Amazon Rekognition、Sightengine 和 Hive;本文中 OpenAI、Azure Content Safety、Google 和 Mistral 的审核 API 只记载了文本或图片输入[3][7][11]。使用文本加图片的 API 时,你可以自己抽帧再作为图片提交,Hive 描述的自家视频处理方式也是如此[11]。
最好的图片审核 API
如果图片规则很宽,包含酒精、赌博、仇恨符号这类标签,选 Rekognition 或 Sightengine[8][7]。如果只关心色情、暴力和自残,OpenAI 的免费端点也覆盖图片[2]。详见图片审核 API 指南。
开源审核 API
Mistral 的 Shieldstral 1.0 以 Apache 2.0 权重发布,能处理文本和图片,目前处于公开预览[4]。如果你需要在自己的基础设施上跑 Azure 的模型,Azure 以年度承诺的离线容器形式出售 Content Safety[9]。
为你的技术栈选择最好的内容审核 API
从需要检查的媒体出发。纯文本产品可以先用 OpenAI 免费端点或 Mistral Moderation 2,等需要严重程度分级或自定义类别时再换 Azure。以图片为主的产品应看 Rekognition 或 Sightengine 的标签深度,涉及视频的则只剩 Rekognition、Sightengine 和 Hive。如果内容不能离开你的服务器,Shieldstral 的开放权重是现实的路径。
剩下的候选之间通常由价格决定,具体数字见审核 API 价格对比。如果你希望 omni-moderation-latest 与其他 reAPI 模型使用同一套异步契约,请看 Content Moderation 模型页。无论如何,最好的内容审核 API 是类别与你实际执行的审核规则相匹配的那一个。
参考资料
- OpenAI. Is the Moderation endpoint free to use? 2026 年 10 月检索自 help.openai.com/en/articles/4936833-is-the-moderation-endpoint-free-to-use
- OpenAI. Moderation guide. 2026 年 10 月检索自 developers.openai.com/api/docs/guides/moderation
- Amazon Web Services. Amazon Rekognition pricing. 2026 年 10 月检索自 aws.amazon.com/rekognition/pricing
- Mistral AI. Shieldstral 1.0 model card. 2026 年 10 月检索自 docs.mistral.ai/models/shieldstral-1-0
- Mistral AI. Mistral Moderation 2 model card. 2026 年 10 月检索自 docs.mistral.ai/models/mistral-moderation-26-03
- Mistral AI. Moderation and guardrailing. 2026 年 10 月检索自 docs.mistral.ai/studio/conversations/moderation
- Sightengine. Pricing. 2026 年 10 月检索自 sightengine.com/pricing
- Amazon Web Services. Using the image and video moderation APIs, Amazon Rekognition Developer Guide. 2026 年 10 月检索自 docs.aws.amazon.com/rekognition/latest/dg/moderation-api.html
- Microsoft Azure. Content Safety pricing. 2026 年 10 月检索自 azure.microsoft.com/en-us/pricing/details/content-safety
- Jigsaw. Perspective API sunset announcement. 2026 年 10 月检索自 perspectiveapi.com
- Hive. Pricing. 2026 年 10 月检索自 thehive.ai/pricing
- Microsoft Learn. Harm categories in Azure AI Content Safety. 2026 年 10 月检索自 learn.microsoft.com/en-us/azure/ai-services/content-safety/concepts/harm-categories
- Google Cloud. Moderate text, Cloud Natural Language API. 2026 年 10 月检索自 docs.cloud.google.com/natural-language/docs/moderating-text
- Amazon Web Services. Amazon Comprehend pricing. 2026 年 10 月检索自 aws.amazon.com/comprehend/pricing
- Amazon Web Services. Trust and safety, Amazon Comprehend Developer Guide. 2026 年 10 月检索自 docs.aws.amazon.com/comprehend/latest/dg/trust-safety.html
- Google Cloud. Detect explicit content (SafeSearch). 2026 年 10 月检索自 docs.cloud.google.com/vision/docs/detecting-safe-search
- Google Cloud. Cloud Vision API pricing. 2026 年 10 月检索自 cloud.google.com/vision/pricing
- Google Cloud. Cloud Natural Language pricing. 2026 年 10 月检索自 cloud.google.com/natural-language/pricing
- reAPI. Content Moderation model page. reapi.ai/models/content-moderation
- Microsoft Learn. What is Azure AI Content Safety? 2026 年 10 月检索自 learn.microsoft.com/en-us/azure/ai-services/content-safety/overview
- reAPI. Content Moderation API docs. reapi.ai/docs/content-moderation
- OpenAI. omni-moderation model page. 2026 年 10 月检索自 developers.openai.com/api/docs/models/omni-moderation-latest
作者

分类
更多文章

Claude Opus 4.8:编码、诚实度与成本
Claude Opus 4.8 官方基准对比、诚实度改进、Dynamic Workflows 功能、默认努力等级变化及迁移规划详解。


Seedream 5.0 Pro vs GPT Image 2:编辑、定价、4K
对比 Seedream 5.0 Pro 和 GPT Image 2 的图片引用、编辑、遮罩、透明度、分辨率、批量和 API 控制,含实时定价。


Kling 运动控制 API:v2.6 vs v3、价格与输入准备
选择合适的朝向模式、源视频时长、计费档位和参考图像来运行 Kling Motion Control v2.6 或 v3,有效减少人脸和身体漂移。
