LOCAL DATA MASKING

CSV 数据脱敏 / 匿名化

在把客户名单、订单、日志或测试数据交给同事、外包方和 AI 工具前,先按列删除或替换敏感值。所有解析和转换都在当前浏览器完成。

“脱敏”不自动等于不可识别:保留域名、手机号后四位、稳定哈希或其他组合字段,都可能帮助重新识别个人。高风险数据必须按组织的隐私、合同与合规流程处理。

粘贴 CSV / TSV

支持引号内换行、逗号、Tab 和分号分隔。

0 字符

粘贴或上传 CSV/TSV,先确认列规则,再生成脱敏副本。

遮盖、假名化、匿名化不同

打星号和稳定假名主要降低日常暴露,不必然阻止重新识别。真正匿名化要评估剩余字段、外部数据源、稀有组合和使用目的。

哈希必须带盐

手机号、邮箱和短 ID 的候选空间有限,公开 SHA-256 很容易被字典反查。工具使用随机盐并按列计算;盐值仍应单独保管,不能和公开数据一起发送。

先删不需要的列

最可靠的最小化不是把所有列换个写法,而是彻底删除接收方不需要的字段。再对确有用途的列做遮盖或稳定假名,并抽查重复值是否保持一致。

RELATED TOOLS

查看全部工具 →

USE & REVIEW

CSV 数据脱敏 / 匿名化常见问题

查看全部工具指南 →

CSV、TSV 和生成的脱敏数据会上传服务器吗?

不会。分隔符识别、表格解析、字段建议、SHA-256、预览和新 CSV 生成都在当前浏览器完成。页面不会代为保存源数据、盐值或结果;下载文件仍可能包含业务信息,应按原权限管理。

遮盖、假名化和匿名化有什么区别?

遮盖通常把部分或全部字符隐藏,主要降低日常查看风险;假名化让同一人获得稳定替代值,便于关联记录,但掌握映射或其他字段时仍可能识别;匿名化要求个人无法被合理重新识别,必须评估整份数据和外部信息,不能由单个按钮自动保证。

为什么哈希和稳定假名需要盐值?

邮箱、手机号和短 ID 的候选范围有限,直接 SHA-256 可以被字典批量反查。工具把随机盐、列号和原值一起计算;同一盐值下相同原值保持一致。盐若与数据一起公开,保护会减弱;需要跨批次一致时应在受控位置单独保存。

删除整列和固定遮盖应该怎样选择?

接收方完全不需要该字段时优先删除整列,这是最直接的数据最小化。必须保留列结构但不需要区分记录时使用固定遮盖;还要关联同一用户的多行记录时才考虑稳定假名或带盐哈希,并检查其他列能否组合识别。

自动建议能识别所有姓名、证件号和账号吗?

不能。建议只根据字段名和前 30 行的常见邮箱、电话、IP 模式判断。缩写、内部字段名、多语言姓名、订单号与账号容易混淆,必须逐列确认。不要因为某列没有被自动标记就认定它不敏感。

CSV 公式保护为什么默认开启?

以 =、+、-、@ 开头的文本被 Excel 等表格软件打开时可能被当作公式。输出默认在这类值前加入单引号,降低公式注入风险。若目标系统严格要求原始字符,应先用测试文件确认再关闭,并避免直接打开来源不明的数据。