工具

把敏感数据去掉,再粘进 AI。

每天都有人把合同、表格或日志粘贴到助手里,却没注意到一起发送出去的还有什么。在这里,文本会在你自己的浏览器中被扫描并加上掩码,不经过任何服务器,包括我们的服务器。

所属模块
主权
输入
一段文本
运行位置
你的浏览器
费用
免费,无需注册
100%在你的浏览器中运行,文本不会离开你的设备
这个工具做什么

你粘进 AI 的东西,已经出了公司

把文本粘贴到助手里,就是把它发送到第三方服务器。大多数时候这无关紧要。问题在于某一天,客户的CPF、信用卡号、代码仓库的API密钥或带有生产环境令牌的日志也一起被发了出去,而没人察觉,因为文本太长,而赶时间的心情更急。

该工具会扫描文本,查找十二种敏感数据类型,并用保留原格式的掩码替换每一处,让文本保持可读。CPF、CNPJ和信用卡号会经过校验位验证,否则任何十六位数的订单号都会被标记为信用卡号。

工作原理
  1. 01

    选择要搜寻什么

    共十二类可选。那些几乎必然是真泄漏的,默认已经打开。

  2. 02

    粘贴文本

    你打字时扫描就在进行,全在你的浏览器里。没有任何请求离开这个页面。

  3. 03

    复制遮蔽后的版本

    格式得以保留,CPF看起来依然像CPF,因此模型能理解上下文,却不会收到真实数据。

常见问题
01

我的文本会被发到别处吗?

不会,这正是这个工具存在的全部意义。检测和遮蔽都在你的浏览器里用 JavaScript 完成。这个页面背后没有任何 API 路由:让你把最想保护的那段文本发到我们的服务器上,本身就自相矛盾。
02

能识别哪些类型的数据?

身份证号与企业代码、银行卡、邮箱、电话、邮编、IP 地址、API 密钥与 JWT 令牌、支付密钥、IBAN、护照和日期。证件号和银行卡按校验位验证,不只看格式。
03

为什么要验证校验位?

为了不把不是的东西也标记出来。一个十六位数的订单号看起来像信用卡号,一个十一位数的协议号看起来像CPF。有了校验位验证,只有真正可能存在的号码才会被标记,文本不会被错误的掩码盖满。
04

遮蔽就足以符合个人信息保护法了吗?

这是一步,不是认证。去掉直接标识符能大幅降低风险,但个人信息也可能藏在姓名、职务、地址里,或藏在工具无法判断的细节组合中。请把它当作粘贴前的基本卫生,而不是法律意见。
05

这个工具能找全吗?

不能,老实说就是这样。它识别的是明确定义的模式。人名、完整书写的地址以及格式不常见的机密信息会被漏掉。粘贴前请先检查结果,这个工具能降低风险,但不能替代人工核查。
06

如果数据确实必须送到模型那里呢?

那答案就不是遮蔽,而是选择模型在哪里运行。开放权重的模型跑在你自己的基础设施上,数据不出公司就能被处理。这正是 Rovemark 存在的目的所在。

如果数据连遮蔽后也不能出去呢?

有些工作不能接受掩码处理。对于这些情况,出路是在自己内部运行模型,而这正是Rovemark自主基础设施所实现的。