基于 Vettly API 的 AI 内容审核 MCP 服务,支持文本、图片、视频多模态检测,提供可审计的决策与成本追踪
说明:
## 核心用法
Vettly Content Moderation 是一个通过 MCP 协议接入的 AI 内容审核服务,依托 `@vettly/mcp` 服务器实现与 Vettly API 的集成。该 skill 提供完整的审核生命周期管理:从策略配置(`validate_policy`、`list_policies`)、内容检测(`moderate_content`)到审计追踪(`get_recent_decisions`、`get_usage_stats`)。支持文本、图片、视频三种内容类型,采用基于 YAML 的策略引擎,允许用户自定义不同类别的阈值(如毒性 0.8、垃圾信息 0.6)及对应动作(flag/block)。
## 显著优点
**多模态覆盖**:单一 API 统一处理文本、图片、视频,降低多供应商对接成本。
**策略即代码**:YAML 格式的可版本化策略配置,配合 `validate_policy` 预检机制,避免生产环境配置错误。
**全链路可审计**:所有审核决策附带 provider、latency、cost 元数据,支持 `get_recent_decisions` 回溯,满足合规审计需求。
**成本透明化**:内置 `get_usage_stats` 提供细粒度成本追踪,便于预算控制与异常检测。
## 潜在缺点与局限性
**供应商锁定**:完全依赖 Vettly 专有 API,策略语法、评分体系与第三方不互通,迁移成本高。
**网络依赖**:内容审核需实时调用云端 API,图片/视频 URL 需可公网访问,离线场景无法使用。
**黑盒评分**:尽管返回 category scores,但具体模型架构、训练数据、偏见基准未公开,可解释性受限。
**成本累积**:按调用量计费,高流量场景下 `get_recent_decisions` 的频繁查询可能产生意外费用。
## 适合人群
– 需要快速搭建 UGC 审核体系的中小型产品团队
– 运营社区、论坛、电商平台的内容安全负责人
– 追求”审核即服务”、不愿自建 ML infra 的工程团队
– 有合规审计要求(需保留审核决策记录)的企业
## 常规风险
**API 密钥泄露**:`VETTLY_API_KEY` 以环境变量注入,若本地配置不当或日志泄露,可能导致账户被盗刷。
**内容隐私**:图片/视频需上传至可访问 URL,敏感内容存在传输与存储暴露风险。
**误判风险**:AI 审核存在假阳性/假阴性,建议关键场景保留人工复核机制,避免自动 block 导致用户申诉。
**服务连续性**:依赖 Vettly 基础设施可用性,需设计降级策略(如审核队列缓冲)应对 API 超时或故障。









