目前市面上的图片翻译接口都是收费的,不过效果确实很好,可以在原图的基础上进行翻译,然后返回翻译后的图片。但接口真的是太贵了。
于是我换了一个思路,使用免费的 ZOCR 识别方案 提取文字,然后再结合 AI 大模型进行处理,显著降低了成本。
具体的流程是:前端将图片转为 WEBP 压缩体积 -> ZOCR 提取文字 -> 大模型清洗 -> 修复 -> 合句 -> 输出双语对照。
效果如下:
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.