内容审核
自动审核内容合规性,识别敏感信息并给出处置建议,降低人工审核成本与合规风险。
适用场景
1
UGC社区帖子与评论的实时合规审核
2
电商商品标题、详情页与用户评价的违禁词检测
3
企业内网文档、邮件与知识库的敏感信息筛查
4
直播弹幕与短视频文案的实时风控拦截
核心Prompt(安装配置用)
你是企业级内容审核Agent,负责对输入文本进行合规性审核。你的任务是识别其中是否包含敏感信息、违禁内容或高风险表述,并输出结构化审核结果。
【审核维度】
1. 政治敏感:涉政人物、事件、旗帜、口号等违规表述。
2. 色情低俗:色情描写、性暗示、低俗词汇。
3. 暴力恐怖:暴力行为、恐怖主义、武器制作等。
4. 违禁广告:虚假宣传、医疗夸大、金融荐股、赌博引流。
5. 隐私泄露:手机号、身份证号、银行卡号、住址等个人信息。
6. 辱骂歧视:人身攻击、地域歧视、性别歧视、民族歧视。
【输出格式】严格输出JSON:
{
"risk_level": "high|medium|low|none",
"categories": ["命中的违规类别"],
"evidence": ["命中的原文片段"],
"reason": "判定理由,50字内",
"suggestion": "pass|review|block",
"confidence": 0.0-1.0
}
【约束条件】
- 仅依据输入文本判断,不臆测上下文。
- 无法确定时输出review并说明原因,不擅自放行。
- 证据片段必须原文引用,不得改写。
- 不输出任何与审核无关的内容。
- 对同一文本保持判定一致性。
所需工具 / API对接
需对接:内容审核API(阿里云绿网/腾讯天御)、敏感词库(本地或云端)、企业IM告警API(钉钉/企微/飞书)、工单系统API(Jira/禅道)、数据库(MySQL/PostgreSQL)用于审核记录存储、日志服务(ELK/SLS)。
安装部署步骤
11. 环境准备:确认服务器Python 3.9+,执行 python -V 验证;安装Docker并启动。
22. 安装依赖:pip install requests openai pymysql python-dotenv;克隆Agent框架仓库并进入目录。
33. 配置参数:复制 config.example.yaml 为 config.yaml,填入审核阈值、敏感词库路径、告警Webhook。
44. 导入Prompt:将core_prompt写入 prompts/content_audit.txt,并在config中引用该路径。
55. 连接工具API:在 .env 中配置 AUDIT_API_KEY、DB_URL、ALERT_WEBHOOK,运行 python test_conn.py 验证连通。
66. 测试验证:执行 python audit.py --input "测试文本",检查输出JSON是否符合预期风险等级。
77. 上线部署:docker build -t content-audit-agent . && docker run -d -p 8080:8080 content-audit-agent,对接业务系统接口。
88. 监控运维:配置日志采集与告警,每日抽检审核准确率,迭代敏感词库。
配置参数
| 参数名 | 说明 | 默认值 |
|---|---|---|
risk_threshold |
触发拦截的风险分数阈值 | 0.8 |
review_threshold |
触发人工复核的阈值 | 0.5 |
sensitive_word_path |
本地敏感词库文件路径 | ./data/words.txt |
alert_webhook |
告警通知Webhook地址 | |
db_url |
审核记录存储数据库连接串 | mysql://user:pass@localhost:3306/audit |
效果示例
输入:"加微信xxx,教你三天赚十万,稳赚不赔!"
输出:{"risk_level":"high","categories":["违禁广告","隐私泄露"],"evidence":["加微信xxx","三天赚十万"],"reason":"含导流联系方式与虚假收益承诺","suggestion":"block","confidence":0.95}
该结果可直接触发拦截并通知运营复核。
输出:{"risk_level":"high","categories":["违禁广告","隐私泄露"],"evidence":["加微信xxx","三天赚十万"],"reason":"含导流联系方式与虚假收益承诺","suggestion":"block","confidence":0.95}
该结果可直接触发拦截并通知运营复核。
常见问题
Q1:审核准确率如何保障?
A1:结合敏感词库初筛+大模型语义判定,双通道降低误判,建议上线前用500条标注样本测试。
Q2:支持多语言吗?
A2:核心Prompt支持中英文,其他语种需在Prompt中补充语种说明与词库。
Q3:响应延迟多少?
A3:单条文本平均200-500ms,高并发场景建议加缓存与异步队列。
Q4:如何更新敏感词库?
A4:替换words.txt后重启服务,或配置定时任务热加载。
Q5:误拦怎么办?
A5:将误判样本加入白名单库,并调整review_threshold阈值。
A1:结合敏感词库初筛+大模型语义判定,双通道降低误判,建议上线前用500条标注样本测试。
Q2:支持多语言吗?
A2:核心Prompt支持中英文,其他语种需在Prompt中补充语种说明与词库。
Q3:响应延迟多少?
A3:单条文本平均200-500ms,高并发场景建议加缓存与异步队列。
Q4:如何更新敏感词库?
A4:替换words.txt后重启服务,或配置定时任务热加载。
Q5:误拦怎么办?
A5:将误判样本加入白名单库,并调整review_threshold阈值。
企业落地建议
部署方式建议优先私有化Docker部署,保障数据不出域,适合金融、政务、医疗等强合规行业。成本估算:中小规模(日均10万条)约需1台4核8G服务器,API调用成本约每月数百至数千元,具体取决于模型选型。注意事项:上线前务必用真实业务样本做回归测试,建立人工复核兜底机制,避免全自动拦截引发误伤;敏感词库需定期更新并留存审核日志以备审计。需要我们帮你落地吗?可以试试免费AI诊断→
需要我们帮你落地?
专业团队帮你从0到1部署企业AI Agent,含安装配置、定制开发、持续运营