帮你快速理解、总结文档立即下载

数据分类分级

最近更新时间:2026-09-11 20:42:30
我的收藏

概述

数据分类分级用于识别 Catalog 中字段所承载的敏感信息(例如手机号、身份证号、邮箱、银行卡号等),并基于识别结果统一推动列级脱敏、行级过滤、访问审计等下游策略落地。DataBuddy 提供两类能力,配套同一套敏感标签与脱敏策略元数据:
敏感识别结果写入 Skill :当 AI 在 Catalog 字段上识别出敏感数据后,由 Skill 把识别结论(敏感标签、置信度、建议脱敏策略)写回到对应字段,作为列级脱敏的依据。
脱敏策略管理 Skill :用于在 Buddy 对话中按业务语义创建脱敏策略、维护用户组到脱敏方法的映射,并把策略关联到一个或多个敏感标签。
提示
当前版本中,数据分类分级以 Skill 接口形式 提供,由 Buddy 智能体和 AI 识别链路调用。可视化的「分类分级管理页面」将在后续迭代上线,本文以 Skill 行为为主。脱敏策略创建后的查询体验、字段绑定方式与列级脱敏一致,详见 列级权限控制

核心概念

概念
说明
敏感标签
描述字段中数据敏感类型的元数据标签,例如 PII/手机号PII/身份证号Finance/银行卡号。所有标签共享同一套租户级命名空间。
脱敏策略
描述字段被读取时按用户组应用的脱敏方法集合。一个脱敏策略可关联多个敏感标签。
脱敏方法
系统内置的字段值变换方式(例如掩码、Hash、保留首/末位)。脱敏方法按用户组生效,未匹配的用户组返回明文。
敏感识别结果
AI 模型对某 Catalog 字段给出的敏感判定,包含敏感标签、置信度,以及推荐绑定的脱敏策略。
字段绑定
把脱敏策略关联到具体 Catalog → Schema → Table → Column 的动作。一个字段同一时间仅绑定一个脱敏策略。

前提条件

当前账号已能登录工作空间,并具备 Buddy 使用权限。
维护脱敏策略时,当前账号在目标 Catalog 中具备策略管理权限(默认为 Workspace 管理员、数据安全管理员)。
写入敏感识别结果时,调用方在目标 Table 上拥有 OwnerManage 权限。权限语义参考 成员与权限管理
已规划好本工作空间的敏感标签命名规范(例如统一前缀 PII/Finance/Internal/),避免相同语义出现多份标签。

使用限制

限制项
说明
适用对象
敏感标签、脱敏策略针对当前租户 + 当前地域内的所有 Catalog 共享。
字段绑定关系
一个字段同一时间仅可绑定一个脱敏策略;多次写入将以最近一次结果为准。
用户组覆盖
脱敏方法按用户组生效;未在策略中配置的用户组查询该字段时返回明文。
脱敏方法范围
当前提供系统内置脱敏方法,暂不支持自定义脱敏函数。
调用方式
当前版本仅通过 Skill 接口维护与写入分类分级结果,可视化管理页面将在后续上线。

使用方式

维护脱敏策略:脱敏策略管理 Skill

脱敏策略管理 Skill 用于在 Buddy 对话中:
创建、更新、删除脱敏策略。
维护脱敏策略的关联用户组与脱敏方法。
把一条脱敏策略关联到一个或多个敏感标签。
典型调用语义如下(实际 Skill 名与参数以 Buddy 实际暴露的版本为准):
为「客户手机号」创建脱敏策略:
- 关联敏感标签:PII/手机号
- 用户组「客服一线」:保留首尾各 3 位、其余替换为 *
- 用户组「数据分析师」:仅返回 Hash 结果
- 其他用户组:默认返回明文
Buddy 收到该意图后,会调用脱敏策略管理 Skill 创建策略并返回策略 ID,可在后续敏感识别结果写入时引用。
提示
策略一旦创建,与列级脱敏共用同一套语义;后续在 Catalog 表详情页的字段绑定、SQL / Notebook 查询时的运行时脱敏行为,请参考 列级权限控制

写入敏感识别结果:敏感识别结果写入 Skill

敏感识别结果写入 Skill 用于把 AI 模型的敏感识别输出固化到 Catalog 字段元数据上。典型流程:
1. AI 识别链路对 Catalog 中的目标字段进行扫描,得到候选敏感标签和置信度。
2. 业务侧(Buddy 或外部流程)按阈值筛选可信的识别结果。
3. 调用敏感识别结果写入 Skill,将以下信息写回字段:
敏感标签(如 PII/手机号)。
置信度(可选,用于审计与后续复核)。
推荐脱敏策略(可选,可直接引用脱敏策略管理 Skill 创建的策略 ID)。
1. 写入成功后,下游列级脱敏、行级过滤、访问审计逻辑均按最新的敏感标签、脱敏策略生效。
调用约定建议:
约定
建议做法
标签命名
统一沿用工作空间已规划的标签命名空间,避免出现 phone / mobile / PII/手机号 并存。
写入幂等性
对同一字段多次写入时,以本次写入的标签和策略为准;如需追溯历史结果,请在调用方记录调用日志。
异常处理
写入失败时由调用方做重试或人工复核,避免静默丢失敏感识别结论。

常见问题

Q:AI 识别给出的敏感标签可信度不高怎么办?

A:建议在敏感识别结果写入 Skill 之前由业务侧按置信度阈值过滤,仅写入达到阈值的标签;对低置信度结果可走人工复核流程,复核通过后再写入。

Q:字段已绑定脱敏策略,再次写入新的识别结果会怎样?

A:以最近一次写入为准,原绑定关系会被覆盖。如果业务上需要保留历史绑定记录,请在调用方自行记录变更日志。

Q:脱敏策略中未覆盖的用户组查询字段时会返回什么?

A:默认返回明文。若需要对未覆盖用户组强制脱敏,请在策略中显式追加用户组并指定脱敏方法。

Q:可视化的分类分级管理页面什么时候上线?

A:当前版本只提供 Skill 接口;可视化页面在后续迭代规划中。在管理页面上线前,建议通过 Buddy 对话或自动化流程统一调用 Skill 维护标签与策略。

相关文档