不知道大家有没有遇到过:复制过来的编号,肉眼看着一样,搜索或者比较时就是对不上。
比如这两行:
MO-0000
МO-0000
第二行开头是西里尔字母 М,不是英文字母 M。类似的还有零宽空格、全角字母,混进文本里以后不太好找。
我写了个 VS Code 插件 用来辅助排查这些字符的。会标出可疑的位置,鼠标放上去能看字符编码和提示原因;看不见的字符,也能从问题列表直接跳过去。
VS Code 本身有 Unicode 高亮,我这个主要围绕中文混排做了一些默认规则: 普通简繁体中文、生僻字、常用中文标点默认放行,重点提示易混淆字母、不可见字符、特殊空白和全角字母数字。需要的话,也可以自己配置放行范围。
检测在本地完成,不上传内容,不会自动修改原文。目前检查的是打开的文档。 已经上架 VS Code 扩展市场,搜索 Unicode Inspector。
源码也放出来了: https://github.com/zyz954489346/unicode-inspector-zh
想请大家帮忙试试,主要想看看:
另外也想听听大家平时怎么处理这类问题,以及这个插件相比内置功能还有哪些地方值得改。
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.