在线 OCR 用着不踏实,我把识别模型放进浏览器里了

20 小时 10 分钟前
 fgghyyfk

最近给图映加了个 OCR 。合同、订单和后台截图经常需要提取文字,但这类图片直接丢给在线 OCR ,我自己用着也有点顾虑,所以这次还是把模型放进浏览器本地跑。

目前做了三档:普通截图用 6 MB 的极速版;复杂排版和日文用 31 MB 的专业版;小字、低清扫描件再用 138 MB 的极致版。第一次使用需要下载模型,后面直接走浏览器缓存。识别过程放在独立 Worker 里,界面也重新收了一遍,原图、模型和识别结果现在都放在一屏里。

结果会保留文字位置、置信度和表格结构,表格复制到 Excel 时用 Tab 分列,也能导出 TXT 、Markdown 和 JSON 。现在支持中英日及几种常见欧洲语言,韩文暂时还没有。

OCR:https://imging.ai/ocr.html

图映还提供本地图片压缩、常用格式转换、动图制作和视频抠背景。常用处理尽量留在浏览器本地完成,免费、免注册。

763 次点击
所在节点    分享创造
3 条回复
needpp
19 小时 53 分钟前
不错 用的什么模型
Wcowin
19 小时 50 分钟前
@needpp 写的有:PP-OCRv6
tyler2002
19 小时 18 分钟前
不错

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1237822

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX