DESENS AI 功能
使用本地模型辅助发现候选敏感区间,并了解 AI 检测、数据集和训练边界。
AI 功能
DESENS 的 AI 功能默认不参与脱敏。启用本地模型后,AI 仅生成候选敏感区间和置信度,最终结果仍必须人工复核。
启用本地模型
- 打开“设置”页面。
- 从 Hugging Face(默认使用
hf-mirror.com)或魔搭社区下载模型,或登记本地 GGUF 文件。 - 等待模型完成 magic、可读性和 SHA-256 校验。
- 点击“应用模型”。
- 打开顶部 AI 功能开关。
项目预设 Qwen 2.5 0.5B Instruct。模型文件不随安装包发布,需在本地单独下载或登记。
检测方式
未启用模型时,系统使用敏感库、正则表达式、中文姓名识别和 Presidio 等规则检测。启用模型后,以规则检测结果为基础,再合并 AI 候选结果。
AI 不会直接覆盖原始文件,也不会绕过人工确认。检测完成后,请在脱敏页查看高亮区域,保留正确结果、取消误识别,并确认后再导出。
数据集与训练
规则、人工确认结果和标注数据可在本机分离保存,用于沉淀组织专属脱敏数据集。数据集支持标注、导入导出和版本管理。
系统为本地 LoRA 训练和评估预留基础模型、数据集版本及训练配置的关联。训练任务不会自动替换当前推理模型;训练执行和训练产物启用都需要用户明确确认。
使用边界
AI 适合辅助发现规则难以覆盖的上下文信息,不适合替代规则校验或人工审查。涉及身份证号、银行卡号、合同编号等高风险字段时,应优先完善规则并逐项复核。
