行动计划

把指南转化为安全试用流程

在使用真实数据前,请先用合成示例完成这些步骤。勾选状态只保留在当前标签页。

0%0/4 已完成
  1. 打开工具
  2. 打开工具
  3. 打开工具
  4. 打开工具

此清单不创建账户、不向服务器发送数据,并会在刷新页面后清除。

01

先建立数据清单与威胁模型

除姓名、邮箱和电话等直接标识符外,还要列出自由文本、文件名、用户代码以及组合后可间接识别个人的字段。只有明确接收者和用途,才能选择适当的脱敏强度。

请构造保留代表性语言、标点和字段长度的合成样例。这样既能复现错误,也不会在检查记录中复制个人数据。

  • 区分直接与间接标识符。
  • 记录接收者和处理目的。
  • 准备合成验收样例。
02

有意识地管理 Unicode 变化

视觉相同的文本可能由不同码点或组合序列构成。规范化有助于匹配,但不应静默修改已签名、具有证据意义或需要按字节比较的数据。

拉丁、西里尔和希腊字母中的易混淆字符可能误导用户名或域名检查。扫描结果只用于安排复核优先级,不能证明恶意或真实身份。

03

执行脱敏前后验收

使用差异视图确认敏感值已移除、占位符无法重新关联记录,同时任务所需上下文仍然存在。只看匹配数量可能漏掉自由文本中的泄露。

误报也应记录。如果产品代码被识别为电话号码,可缩小规则范围;但不能为了报告更整洁而压制真实风险。

04

用抽样与人工批准关闭发布门禁

除正常样例外,还应测试重音姓名、从右到左文本、CJK 字符、空字段、错误邮箱和超长行。第二人抽样复核用于补充而非替代模式检查。

记录规则版本、样例编号、预期与观察结果、批准人和复审触发条件,而不是原始值。脱敏并不保证匿名化或法规合规。

05

此工作流中的工具与职责

每个工具提供不同证据,任何单一输出都不能批准整个流程。请从合成示例开始,执行验收检查;超过边界时不要进入下一步。

  • 个人数据遮蔽工具
  • Unicode 规范化与字符检查
  • 文本差异比较
  • Unicode 易混淆字符扫描器
应用核验

把指南转化为可重复的检查流程

请使用这套包含 4 个工具的检查计划来落实《多语言数据脱敏质量保证指南》。目标:将脱敏范围、Unicode 规范化、易混淆字符风险和前后对比转化为可重复验收计划的实用指南。 请先用安全示例代替真实数据,并记录每一步的预期结果与验收决定。

01

个人数据遮蔽工具

准备
个人数据遮蔽工具的输入应为您有权检查的、已合成或最小化的代码、配置、标识符或文件内容。本次处理目标是:检测并遮蔽常见的邮箱、电话、IP 和身份标识模式。处理敏感真实数据前,请先用合成示例确认格式。
执行
运行设备端处理。个人数据遮蔽工具为实现“检测并遮蔽常见的邮箱、电话、IP 和身份标识模式”采用以下可解释方法:内容不会执行;只应用可解释的静态模式和受限的浏览器操作。
验收检查
验收检查:接受个人数据遮蔽工具的结果前,请完成在源位置人工复核,并使用适当的专业安全工具或授权流程独立验证;核验证据应与“检测并遮蔽常见的邮箱、电话、IP 和身份标识模式”这一目标一致。个人数据遮蔽工具的使用边界:基于模式的脱敏不能证明已发现全部个人数据,也不能证明满足 KVKK/GDPR;字段清单、重新识别风险和样本输出仍须人工复核。
预期输出
个人数据遮蔽工具完成后会提供证据位置、严重程度、误报可能性和下一步核验操作,并围绕“检测并遮蔽常见的邮箱、电话、IP 和身份标识模式”组织结果。. 检测并遮蔽常见的邮箱、电话、IP 和身份标识模式。
02

Unicode 规范化与字符检查

准备
Unicode 规范化与字符检查的输入应为在保留用途和目标语言的前提下需要编辑或比较的纯文本。本次处理目标是:检查规范化形式、码点和不可见字符。处理敏感真实数据前,请先用合成示例确认格式。
执行
运行设备端处理。Unicode 规范化与字符检查为实现“检查规范化形式、码点和不可见字符”采用以下可解释方法:在保留 Unicode、行和词边界的同时应用确定性文本规则。
验收检查
验收检查:接受Unicode 规范化与字符检查的结果前,请完成对可能改变语义的句子、专有名词、数字、标点和多语言字符进行前后比较;核验证据应与“检查规范化形式、码点和不可见字符”这一目标一致。Unicode 规范化与字符检查的使用边界:语言、语义和上下文仍需人工最终审核。
预期输出
Unicode 规范化与字符检查完成后会提供编辑后的文本、变更摘要以及可量化的语言或结构指标,并围绕“检查规范化形式、码点和不可见字符”组织结果。. 检查规范化形式、码点和不可见字符。
03

文本差异比较

准备
文本差异比较的输入应为在保留用途和目标语言的前提下需要编辑或比较的纯文本。本次处理目标是:清晰标记新增和删除的行或词语。处理敏感真实数据前,请先用合成示例确认格式。
执行
运行设备端处理。文本差异比较为实现“清晰标记新增和删除的行或词语”采用以下可解释方法:在保留 Unicode、行和词边界的同时应用确定性文本规则。
验收检查
验收检查:接受文本差异比较的结果前,请完成对可能改变语义的句子、专有名词、数字、标点和多语言字符进行前后比较;核验证据应与“清晰标记新增和删除的行或词语”这一目标一致。文本差异比较的使用边界:语言、语义和上下文仍需人工最终审核。
预期输出
文本差异比较完成后会提供编辑后的文本、变更摘要以及可量化的语言或结构指标,并围绕“清晰标记新增和删除的行或词语”组织结果。. 清晰标记新增和删除的行或词语。
04

Unicode 易混淆字符扫描器

准备
Unicode 易混淆字符扫描器的输入应为在保留用途和目标语言的前提下需要编辑或比较的纯文本。本次处理目标是:以可解释证据查找混合文字、零宽与双向控制字符。处理敏感真实数据前,请先用合成示例确认格式。
执行
运行设备端处理。Unicode 易混淆字符扫描器为实现“以可解释证据查找混合文字、零宽与双向控制字符”采用以下可解释方法:在保留 Unicode、行和词边界的同时应用确定性文本规则。
验收检查
验收检查:接受Unicode 易混淆字符扫描器的结果前,请完成对可能改变语义的句子、专有名词、数字、标点和多语言字符进行前后比较;核验证据应与“以可解释证据查找混合文字、零宽与双向控制字符”这一目标一致。Unicode 易混淆字符扫描器的使用边界:语言、语义和上下文仍需人工最终审核。
预期输出
Unicode 易混淆字符扫描器完成后会提供编辑后的文本、变更摘要以及可量化的语言或结构指标,并围绕“以可解释证据查找混合文字、零宽与双向控制字符”组织结果。. 以可解释证据查找混合文字、零宽与双向控制字符。
何时应停止?

个人数据遮蔽工具适用以下边界:个人数据遮蔽工具的使用边界:基于模式的脱敏不能证明已发现全部个人数据,也不能证明满足 KVKK/GDPR;字段清单、重新识别风险和样本输出仍须人工复核。 如果未满足该条件,请勿把输出传递到工作流的下一步。

检查记录

落实《多语言数据脱敏质量保证指南》时,请记录工具名称、所选设置、浏览器版本,以及“使用个人数据遮蔽工具完成:检测并遮蔽常见的邮箱、电话、IP 和身份标识模式”的接受或拒绝理由,而不是敏感内容。这样既能重复检查,也不会复制真实数据。