功能概述
敏感数据检测是大模型安全的数据安全能力,基于数据分类分级检测引擎,实时检测用户输入和大模型输出中的敏感数据,防止企业敏感数据及个人身份信息(PII)泄露。
大模型在与用户交互过程中,可能因以下原因泄露敏感数据:
用户主动输入:用户在 Prompt 中输入自己的身份证号、银行卡号、手机号等个人信息。
模型输出泄露:模型基于训练数据或 RAG 检索结果,在回答中附带企业的密钥、数据库连接串、内部地址等敏感数据。
检测类型
敏感数据检测内置50多种敏感数据类型检测规则,对交互内容进行实时识别与分级处置,满足数据安全合规要求。覆盖以下类别:
个人身份信息:身份证、护照等。
金融信息:银行卡、VISA 卡号等。
凭证密钥:密码凭证、API Key 等。
通讯信息:邮箱、手机号等。
位置信息:经度、纬度等。
设备标识:IP 地址、MAC 地址等。
配置步骤
流量接入
前提条件
操作步骤
1. 登录 Web 应用防火墙控制台,在左侧导航栏,选择大模型安全 > 防护配置。
2. 选择目标业务实例和域名,单击自定义防护规则。
3. 在自定义防护规则页面,单击添加规则。
4. 在添加自定义防护规则窗口中,进行参数配置。
5. 检测内容选择数据分类,具体参数说明详情请参考 参数说明。
6. 完成所有参数设置后,打开规则开关,然后单击确定提交配置,该规则即可生效。
SDK/API 接入
前提条件
已通过 SDK/API 接入 方式将大模型业务接入大模型安全功能。
已调用 DescribeLLMContentSecCheck 接口将待检测内容上报至大模型安全功能。
操作步骤
1. 登录 Web 应用防火墙控制台,在左侧导航栏选择大模型安全 > SDK 接入。
2. 在目标应用的操作列,单击防护配置。
3. 在防护配置区域,打开敏感数据检测功能开关。
4. 单击敏感数据检测,切换至敏感数据检测页签。
5. 在规则列表中,找到需要启用的规则,单击右侧规则开关将其打开。
6. 在执行动作列下拉框中,选择命中后的处理方式:
观察:记录命中日志,不阻断请求。在策略上线初期可优先选择该动作,便于评估误报率。
拦截:阻断请求,并返回拦截提示。对于输入内容,将阻断用户发往源站的请求;对于输出内容,将停止模型输出并返回提示信息。
7. 在检测模式列下拉框中,选择检测方向:
仅检测入向:仅检测输入提示词。
仅检测出向:仅检测模型输出。
入向出向都检测:同时检测输入与输出。
8. 如需对多条规则进行批量操作,可勾选规则前的复选框,单击列表上方的批量配置,统一调整执行动作、检测模式和规则开关。
注意事项
根据业务实际涉及的数据类型启用对应规则。例如面向消费者的业务应重点关注手机号、身份证、银行卡等个人身份与金融信息;企业内部系统应重点关注密钥、连接串等凭证类型。
建议对严重、高危类型启用拦截,对中危、低危类型先以告警模式观察,避免误报影响业务。
模型输出泄露敏感数据往往比用户主动输入更难察觉,建议对输入输出两侧均启用检测。
对于必须透传的敏感数据场景,建议在业务侧先完成数据脱敏,再接入检测作为兜底防线。
相关文档
流量接入
自定义防护规则
日志审计