内容过滤
管理后台 → 系统设置 → 内容过滤
对用户发往大模型的请求做敏感词检查,四种力度可选,适合内容合规要求的运营环境。
过滤策略
| 配置项 | 默认值 | 说明 |
|---|---|---|
content_filter_mode 过滤策略 | off | 四档枚举,见下表 |
| 模式 | 行为 |
|---|---|
off 关闭 | 不做任何检查 |
log 仅记录 | 请求照常转发,命中敏感词仅记录日志(试运行 / 观察期用) |
replace 替换敏感词 | 命中的敏感词替换为指定文本后再转发,请求不中断 |
block 拦截请求 | 命中即拒绝请求,返回拦截提示,不消耗上游额度 |
上线建议
词库没有把握时先开 log 跑一周,观察误伤率后再切 replace 或 block。
过滤配置
| 配置项 | 默认值 | 说明 |
|---|---|---|
content_filter_words 敏感词列表 | [] | JSON 数组,支持通配符 *(如 "违禁*" 匹配所有以「违禁」开头的词) |
content_filter_replacement 替换文本 | *** | replace 模式下替换命中词的文本 |
content_filter_response 拦截提示 | 内容包含敏感词,请修改后重试 | block 模式下返回给客户端的报错信息 |
词库示例:
json
[
"敏感词1",
"敏感词2",
"违禁*",
"*诈骗"
]WARNING
词库是全平台生效的——对所有租户、所有模型的请求做检查。词库过大(数千词以上)会增加每个请求的处理延迟,按需精简。