【开源】本地脱敏还原网关 maskit 0.4版本发布,支持内置模型和浏览器扩展

xiaoyaotan 2026-09-22 10:28 1


^-^
开源模版
现在日常写代码、排查线上 Bug 越来越依赖 AI,但经常会遇到不得不把内网 IP、线上数据库连接串、业务手机号/身份证、AK/SK 等信息带入上下文的场景,合规和隐私风险很大。
于是我花时间写了一个本地桌面级 AI 脱敏代理网关(Data Maskit),自己已经在重度工作流中**持续自用了一个多月,体验基本稳定顺手了。
[image]
[image]
[image]
[…


刚刚发布0.4.0版本,对比第一次发帖主要新增的重点功能如下:


1. 内置轻量级离线语义模型,深度覆盖社会生活、法律文书、医疗病历、商业合同等多行业场景。自动从自由文本中智能识别人名、机构企业、地理位置。默认关闭,平时写代码防的主要是 Key、密码、内网 IP,这些内置正则规则就能毫秒级搞定,没必要开 NER;在处理真实业务数据、文书合同,或者涉及大量真实中文人名/公司/地址时再开启,这样既保证代码交互轻快,又能针对性防护。




2.新增浏览器扩展,默认支持chatgpt、claude、DeepSeek网页端,支持对话以及常见文档文件




3.支持mac以及优化了docker部署版本,因为穷买不起mac,感兴趣的佬麻烦自行测试一下,反馈反馈


4.优化了界面UI以及一些个性化功能(自认为比之前好看一点 ^-^)


个人精力有限,测试肯定不全面,不保证没有问题,欢迎佬们多多反馈和提交PR,有时间会第一时间处理的


另外觉得还行的话麻烦点一下star呢 ^-^

最新回复 (8)
  • flomoc 09-22 11:07
    1

    最近刚看到 jev 很火,是不是可以把这个决策放到 maskit 里面呢,效果应该会更好

  • xiaoyaotan 楼主 09-22 11:36
    2

    前两天 Jev 刚出来的时候确实评估过这个方向,综合考虑后暂时不考虑集成:



    1. maskit需要的是精准定位敏感词的字符位置并执行替换。Jev 是典型的“离散分类/选择模型”,它只能判断全句“是否有敏感词”,无法实现替换。

    2. 接入jev商业版就违背了数据脱敏后在外发的准则了,开源的话至少也需要几个G的资源开销,而且刚出来,后续如何发展还未可知

    3. 现在结构化数据(手机号,身份证等)使用正则基本不会误伤,结合内置NER模型来处理未知的数据,纯cpu已经能实现毫秒级的脱敏了

  • Jimmy 09-22 15:17
    3

    佬,现在支持恶意指令过滤吗?

  • xiaoyaotan 楼主 09-22 15:28
    4

    目前只有高危的一些审计记录日志之类的,之前考虑过拦截之类的,但是觉得这个功能可能会影响日常正常的使用,暂时只做了日志记录。佬针可以说一下你具体的需求或者场景吗,我看看好实现不

  • Jimmy 09-22 15:30
    5

    基础的拦截


    rm -rf /

    rm -rf ~


    再加入自定义拦截的配置项

  • xiaoyaotan 楼主 09-22 15:47
    6

    实现上来说不太复杂,但是如果启用后会导致本次请求的响应直接被拦截中断,会返回类似的风险提示,这个佬能接受吗

  • Jimmy 09-22 15:48
    7

    可以接受,或者可以加一个开关决定是否启用指令拦截功能

  • R 09-22 16:00
    8



    期待佬的项目越来越完善

* 帖子来源Linux.do
返回