美洽敏感词过滤怎么配置?
在美洽管理后台的“敏感词过滤”模块,先创建词库并选择匹配类型(完全/包含/正则),为每个关键词指定处理动作(屏蔽/替换/告警/转人工),支持批量导入CSV、设置白名单与优先级,保存后在测试环境验证,再上线并通过日志和统计监控效果,必要时结合API或WebHook实现实时拦截与二次处理。并定期更新与审计,保留证据链及培训。

先把原理说清楚:为什么要这样配置
如果把敏感词过滤想成门卫,那词库就是黑名单,规则就是门卫的工作手册。规则决定门卫是直接把人挡在门外(屏蔽)、让人把名字改成别的(替换/掩码)、通知保安(告警)、还是把人带到人工审核处(转人工)。美洽的敏感词功能,就是把这套门卫机制放在客服通道里,既要高效,又要又要尽量不影响正常沟通。
配置前的准备工作
- 确认目标:是为了合规(法律法规)、品牌保护,还是防止客服被恶意词汇影响?目标不一样,优先级和动作策略会不同。
- 收集词表:既有黑名单,也要准备一个白名单(例如公司名、同音词允许)。建议把历史聊天中命中的词导出,做初始清单。
- 确定匹配方式:是否需要正则、是否要支持拼音/谐音、是否考虑 emoji,提前规划。
- 定义动作集合:常见动作包括阻断(拒绝发送)、替换()、告警(给管理员或机器人)、转人工(可配置不同队列)。
- 角色与权限:谁可以改词库、谁可以上线规则、谁能查看日志,明确权限,避免误操作。
一步步配置(实操指南)
1. 进入管理控制台并定位模块
登录美洽控制台,找到「敏感词/内容审核/安全合规」相关板块(各版本名称可能略有不同)。如果没有权限,需要联系管理员开通。
2. 新建词库或规则集
通常可以新建多个词库(按业务线或渠道划分)。给词库命名并备注用途,比如“电商下单场景-高优先级”。
3. 添加关键词与配置字段
添加时一般包含这些维度:
- 关键词文本:单词、短语或正则表达式。
- 匹配类型:完全匹配/包含/正则/前缀/后缀。
- 动作:屏蔽、替换、告警、转人工、记录(仅日志)。
- 优先级:数字越小优先级越高,决定冲突时的处理顺序。
- 白名单例外:指定某些场景或用户不触发该规则。
- 备注/说明:便于审计和团队协作。
4. 批量导入/导出(提高效率)
大多数场景建议先在本地用表格编辑,再批量导入。下面是一个常见的CSV字段示例:
| 字段 | 说明 |
| keyword | 敏感词文本或正则 |
| match_type | exact/contain/regex |
| action | block/replace/alert/transfer |
| replace_text | 替换为文本(屏蔽时可空) |
| priority | 整数,越小优先级越高 |
| scope | 适用渠道或队列 |
| note | 备注 |
匹配策略与正则示例
匹配策略很关键,错误的配置会造成大量误报或漏报。
- 完全匹配:用户发送内容完全等于关键词才触发,误报少但漏报可能多,适合短语或精确词。
- 包含匹配:只要消息包含该字符串就触发,适合脏话等直接词汇。
- 正则匹配:用于复杂场景,例如忽略空格、变形字符或拼音。示例:禁止某词的变形:(?i)p\\s*a\\s*s\\s*s(忽略大小写并允许空格)。
- 分词或模糊:对中文需要注意分词,例如“法轮功”可能会被拆分,正则或同义词扩展更稳妥。
常用正则示例
- 屏蔽简单变形:(?i)毒品|d\\s*r\\s*u\\s*g
- 屏蔽含中文异形空格:(?:(?<=\\b)|\\s)敏感词(?:(?=\\b)|\\s)
- 匹配带符号的电话号码或证件号定制:\\d{6,20}
和自动化/机器人联动
美洽的智能机器人和自动化流程可以和敏感词联动:一旦命中,可以自动发出提醒模板、把会话转给指定人工队列,或触发二次审核流程。关键是把动作和业务流程串起来,比如订单退款场景可以“遇到支付泄露信息自动屏蔽并转人工”。
日志、监控与审计
配置之后,务必打开日志和统计:
- 命中记录包含:会话ID、发言人、关键词、匹配类型、触发动作、时间戳。
- 告警:对高危词设置实时告警到管理员邮箱或企业微信/钉钉。
- 定期报表:按天/周统计误报率、漏报疑似数量、转人工比例。
进阶操作:API 与 WebHook 集成
如果需要在消息发送端做更早拦截,或要把敏感词判断放在自家中控台,可以使用美洽开放的API或Webhook(以你账号权限为准)来实现:
- 消息入站时先调用敏感词检测API,返回动作指令(允许/阻断/替换/告警)。
- 命中后通过Webhook把详情推送到中台,触发企业内部的合规流水线或工单。
- 实现异步校验:先允许发送但在后台做二次检测并在发现问题后回滚/通知。
常见问题与优化建议(像跟同事聊)
- 误报多:检查是否使用泛化的正则或包含匹配过宽,添加白名单词或缩小匹配范围。
- 漏报:注意拼音、谐音、变形字符和emoji,有必要时使用正则或扩展同义词库。
- 性能问题:复杂的正则在高并发下会影响延迟。把高频关键字放在简单匹配集合里,复杂规则做离线或异步处理。
- 多人协作混乱:建立变更流程:谁能修改、测试环境先验证、上线要审批,并保留变更记录。
- 合规与存证:敏感事件要保留原始聊天记录、命中快照与处理凭证,便于事后审计或执法调查。
举个具体场景(我是边写边想)
假设电商客服不允许泄露用户银行卡信息,你可以:
- 建立词库“支付泄露-高危”,添加银行卡正则\\b\\d{12,19}\\b,动作设为“阻断并告警”。
- 再做一个白名单规则,允许客服话术中出现的内部示例号但必须匹配上下文标识符。
- 上线前在测试会话里反复试验不同格式(空格、连字符、隐藏字符)以避免漏判。
- 命中后自动创建工单转人工并把日志发给合规员审查。
权限、流程和治理(别忘了这些)
技术能拦截,但制度保证长期有效:建立词库评审制度(谁提谁负责、季度复核)、明确例外审批流程、培训客服识别规避技巧。此外,敏感词策略应纳入风险评估与应急预案里。
如果你现在就想动手,我可以帮你列出一份初始CSV模板和几个正则样例,或者把你现有聊天记录筛一遍,找出优先要加入词库的词——想怎么开始,说声就行,咱们一步步来。