做了一个漫画翻译的工具网站,分享下实现思路

8 小时 43 分钟前
 hankeyyh

从很早开始看漫画,一直追的是各种汉化组的翻译。感觉修图嵌字都是辛苦活,最近想看看用 AI 能做到哪一步。调研了一下 github ,开源项目还不少。

总体来说,翻译步骤一般包括:

文字定位感觉是最重要的一步,是否找齐所有文字段,框定的范围是否完整,直接决定后续 OCR 的质量和擦字是否干净。很多文字边缘会有振假名的情况,一开始测试总是会漏掉它们,导致擦字有残留。

OCR+翻译其实可以用视觉大模型一次完成,不过测试下来感觉成本有些高,所以还是分成两步。

试用下来效果比较好的模型:

目前这个工具主要用于翻译日漫,做了个在线版本: https://mangasense.xyz

有兴趣可以试试,不用登录。

ps. 感觉 GPU 成本还是挺高的,用的 A10 ,一天 20 多刀...有类似经验的朋友,能讲讲有什么便宜点的办法吗?

506 次点击
所在节点    分享创造
5 条回复
orion1
8 小时 36 分钟前
挺厉害的,
但我试了下漫画直接扔给 AI 也能做到把文字翻译过来镶嵌了
miniliuke
8 小时 13 分钟前
@orion1 是的不追求自动化直接打包发给 gpt 网页就行了...如果没有大模型,是很好的产品,但是被降维打击了,除非成本上面有很大优势
hankeyyh
7 小时 31 分钟前
@orion1 是的,不过我用 gpt 测试发现,大模型返回的图片,一些细节会和原图不同,翻译质量上也差点。估计图片处理的 pipeline 不能很好适配
laurent
7 小时 3 分钟前
和开源的 koharu-rs/koharu 有什么优势呢?
alie123
6 小时 17 分钟前
腾讯云的 A10 你去找渠道商说不定能拿到 2000 以内的价格,量大的话能到 1500 以下(带宽 5M )

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1245216

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX