a6-plugin-ai-content-moderation
概览
Apache APISIX提供两个内容安全审核插件,用于过滤有害内容,覆盖 LLM 请求和响应:
| 插件 | 服务提供方 | 请求 | 响应 | 流式传输 |
|---|---|---|---|---|
ai-aws-content-moderation | AWS Comprehend | ✅ | ✅ | ✅ |
ai-aliyun-content-moderation | Aliyun Moderation Plus | ✅ | ✅ | ✅ |
两者都必须与 ai-proxy 或 ai-proxy-multi 一起使用,以便插件审核已解码的 AI 内容。自 APISIX 3.18.0 起,AWS 支持响应与流式审核,并提供 fail_mode、角色选择以及默认值为 200 的 deny_code。字段表和协议详情请参阅 ai-aws-content-moderation 和 ai-aliyun-content-moderation。
适用场景
- 在内容到达 LLM 前拦截有毒、仇恨或色情内容
- 审核有害的 LLM 响应。非流式响应可在交付前被拒绝;流式检查无法撤回已发送的分块
- 通过可配置阈值执行内容策略
- 直接在服务或路由上应用一致的审核策略
插件执行顺序
ai-prompt-template (priority 1071)
ai-prompt-decorator (priority 1070)
ai-proxy (priority 1040)
ai-aws-content-moderation (priority 1031) ← runs AFTER ai-proxy
ai-aliyun-content-moderation (priority 1029) ← runs AFTER ai-proxy
优先级数值越大,执行越早。两个审核插件都在 ai-proxy 或 ai-proxy-multi 之后运行,以读取已解码的 AI 请求;但它们仍会在请求调用上游 LLM 前拦截命中审核规则的请求。
插件 1:ai-aws-content-moderation
使用 AWS Comprehend DetectToxicContent API 对请求和响应内容进行评分。