把敏感数据去掉,再粘进 AI。
每天都有人把合同、表格或日志粘贴到助手里,却没注意到一起发送出去的还有什么。在这里,文本会在你自己的浏览器中被扫描并加上掩码,不经过任何服务器,包括我们的服务器。
- 所属模块
- 主权
- 输入
- 一段文本
- 运行位置
- 你的浏览器
- 费用
- 免费,无需注册
100%在你的浏览器中运行,文本不会离开你的设备
这个工具做什么
你粘进 AI 的东西,已经出了公司
把文本粘贴到助手里,就是把它发送到第三方服务器。大多数时候这无关紧要。问题在于某一天,客户的CPF、信用卡号、代码仓库的API密钥或带有生产环境令牌的日志也一起被发了出去,而没人察觉,因为文本太长,而赶时间的心情更急。
该工具会扫描文本,查找十二种敏感数据类型,并用保留原格式的掩码替换每一处,让文本保持可读。CPF、CNPJ和信用卡号会经过校验位验证,否则任何十六位数的订单号都会被标记为信用卡号。
工作原理
- 01
选择要搜寻什么
共十二类可选。那些几乎必然是真泄漏的,默认已经打开。
- 02
粘贴文本
你打字时扫描就在进行,全在你的浏览器里。没有任何请求离开这个页面。
- 03
复制遮蔽后的版本
格式得以保留,CPF看起来依然像CPF,因此模型能理解上下文,却不会收到真实数据。
常见问题
- 01
我的文本会被发到别处吗?
- 不会,这正是这个工具存在的全部意义。检测和遮蔽都在你的浏览器里用 JavaScript 完成。这个页面背后没有任何 API 路由:让你把最想保护的那段文本发到我们的服务器上,本身就自相矛盾。
- 02
能识别哪些类型的数据?
- 身份证号与企业代码、银行卡、邮箱、电话、邮编、IP 地址、API 密钥与 JWT 令牌、支付密钥、IBAN、护照和日期。证件号和银行卡按校验位验证,不只看格式。
- 03
为什么要验证校验位?
- 为了不把不是的东西也标记出来。一个十六位数的订单号看起来像信用卡号,一个十一位数的协议号看起来像CPF。有了校验位验证,只有真正可能存在的号码才会被标记,文本不会被错误的掩码盖满。
- 04
遮蔽就足以符合个人信息保护法了吗?
- 这是一步,不是认证。去掉直接标识符能大幅降低风险,但个人信息也可能藏在姓名、职务、地址里,或藏在工具无法判断的细节组合中。请把它当作粘贴前的基本卫生,而不是法律意见。
- 05
这个工具能找全吗?
- 不能,老实说就是这样。它识别的是明确定义的模式。人名、完整书写的地址以及格式不常见的机密信息会被漏掉。粘贴前请先检查结果,这个工具能降低风险,但不能替代人工核查。
- 06
如果数据确实必须送到模型那里呢?
- 那答案就不是遮蔽,而是选择模型在哪里运行。开放权重的模型跑在你自己的基础设施上,数据不出公司就能被处理。这正是 Rovemark 存在的目的所在。
其他免费工具
