写了个 VS Code 插件,用来找长得一样的非英文字母,请大家帮忙挑挑 bug

GodVan 2026-09-16 13:55 1

不知道大家有没有遇到过:复制过来的编号,肉眼看着一样,搜索或者比较时就是对不上。


比如这两行:


MO-0000
МO-0000

第二行开头是西里尔字母 М,不是英文字母 M。类似的还有零宽空格、全角字母,混进文本里以后不太好找。


我写了个 VS Code 插件 用来辅助排查这些字符的。会标出可疑的位置,鼠标放上去能看字符编码和提示原因;看不见的字符,也能从问题列表直接跳过去。


VS Code 本身有 Unicode 高亮,我这个主要围绕中文混排做了一些默认规则:
普通简繁体中文、生僻字、常用中文标点默认放行,重点提示易混淆字母、不可见字符、特殊空白和全角字母数字。需要的话,也可以自己配置放行范围。


检测在本地完成,不上传内容,不会自动修改原文。目前检查的是打开的文档。
已经上架 VS Code 扩展市场,搜索 Unicode Inspector


源码也放出来了: https://github.com/zyz954489346/unicode-inspector-zh


想请大家帮忙试试,主要想看看:



  • 中文、拼音、emoji 混排的时候,有没有误报太多、影响正常使用的情况。

  • 有没有应该提示却漏掉的字符。

  • 提示是否容易理解,大文件下会不会卡顿。


另外也想听听大家平时怎么处理这类问题,以及这个插件相比内置功能还有哪些地方值得改。

最新回复 (0)
    没有回复
* 帖子来源V2EX
返回