DESENS 敏感字段管理
维护预置敏感字段、自定义规则和正则转换规则。
敏感字段管理
敏感字段管理用于维护本地脱敏规则。规则保存在当前设备的浏览器本地存储中,提交文件时会一并传给本机后端。
支持的预置类型
| 类型 | 说明 | 检测方式 |
|---|---|---|
chinese_name | 中文姓名 | 百家姓库与 jieba 分词 |
phone | 手机号 | 正则表达式 |
id_card | 身份证号 | 正则表达式 |
bank_card | 银行卡号 | 正则表达式 |
email | 邮箱地址 | Presidio 与正则 |
landline | 固定电话 | 正则表达式 |
ip_address | IP 地址 | 正则表达式 |
license_plate | 车牌号 | 正则表达式 |
passport | 护照号 | 正则表达式 |
unified_social_credit_code | 统一社会信用代码 | 正则表达式 |
name | 英文姓名 | Presidio |
ssn | 美国社会安全号 | Presidio |
credit_card | 信用卡号 | Presidio |
address | 地址 | Presidio |
date_time | 日期时间 | Presidio |
新增规则
在“敏感字段”页面点击新增,可根据数据特点选择:
- 姓名:添加需要识别的具体姓名。
- 关键词:匹配业务术语、项目名称、内部编号等固定文本。
- 正则表达式:匹配具有稳定格式的账号、单据号或编码。
- 算法校验:适合带校验位的证件号、统一社会信用代码等。
- NLP/ 上下文:根据语义上下文辅助识别复杂字段。
填写规则名称、匹配内容和脱敏方式后保存,并确认规则处于启用状态。点击列表中的编辑按钮可以修改规则,点击 x 可以删除规则。
正则转换
正则转换可以将已添加的敏感信息源转换为正则规则,适合把经常遇到的固定信息快速纳入规则库。转换后请检查表达式的匹配范围,避免过度匹配。
管理建议
- 先使用小样本文档验证规则。
- 规则名称应能说明字段用途和来源。
- 业务规则尽量限定匹配范围,减少误识别。
- 删除或停用规则后,应重新检测文件并人工确认结果。
- 可按组织或行业场景维护专属规则和标注数据集。
