写了个 VS Code 插件,用来找长得一样的非英文字母,请大家帮忙挑挑 bug

1 天前
 GodVan

不知道大家有没有遇到过:复制过来的编号,肉眼看着一样,搜索或者比较时就是对不上。

比如这两行:

MO-0000
МO-0000

第二行开头是西里尔字母 М,不是英文字母 M。类似的还有零宽空格、全角字母,混进文本里以后不太好找。

我写了个 VS Code 插件 用来辅助排查这些字符的。会标出可疑的位置,鼠标放上去能看字符编码和提示原因;看不见的字符,也能从问题列表直接跳过去。

VS Code 本身有 Unicode 高亮,我这个主要围绕中文混排做了一些默认规则: 普通简繁体中文、生僻字、常用中文标点默认放行,重点提示易混淆字母、不可见字符、特殊空白和全角字母数字。需要的话,也可以自己配置放行范围。

检测在本地完成,不上传内容,不会自动修改原文。目前检查的是打开的文档。 已经上架 VS Code 扩展市场,搜索 Unicode Inspector

源码也放出来了: https://github.com/zyz954489346/unicode-inspector-zh

想请大家帮忙试试,主要想看看:

另外也想听听大家平时怎么处理这类问题,以及这个插件相比内置功能还有哪些地方值得改。

403 次点击
所在节点    分享创造
0 条回复

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1242409

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX