最近给图映加了个 OCR 。合同、订单和后台截图经常需要提取文字,但这类图片直接丢给在线 OCR ,我自己用着也有点顾虑,所以这次还是把模型放进浏览器本地跑。
目前做了三档:普通截图用 6 MB 的极速版;复杂排版和日文用 31 MB 的专业版;小字、低清扫描件再用 138 MB 的极致版。第一次使用需要下载模型,后面直接走浏览器缓存。识别过程放在独立 Worker 里,界面也重新收了一遍,原图、模型和识别结果现在都放在一屏里。
结果会保留文字位置、置信度和表格结构,表格复制到 Excel 时用 Tab 分列,也能导出 TXT 、Markdown 和 JSON 。现在支持中英日及几种常见欧洲语言,韩文暂时还没有。
OCR:https://imging.ai/ocr.html
图映还提供本地图片压缩、常用格式转换、动图制作和视频抠背景。常用处理尽量留在浏览器本地完成,免费、免注册。
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.