LLM 翻译复杂文本的较优工程解是什么?

6 月 20 日
 teli
目前是写脚本,调用 deepseek api ,灌入长长的提示词。大部分可以翻译得很好。但一些复杂的,总是会出现一些翻译问题,需要人工修正。
人工修正的方法是,把原文丢给 Google 翻译、ChatGPT 、Gemini 、MiniMax 、GLM…… 看哪家翻译得最好;或者根据它们的输出,自己翻译。
不考虑成本,最佳方案可能是调用各家 LLM ,然后挑一家打分,选择得分最高的译文。但无奈经济能力有限。
所以,有没有较优的工程解?
1829 次点击
所在节点    AI Agent 智能体
5 条回复
unclemcz
6 月 20 日
你当前是全文发给大模型翻译还是分段翻译?
碰上的都是哪些翻译问题呢?
kuhung
6 月 20 日
先设置评估标准,什么叫做好什么叫做不好。有时候翻译不得体,可能是随机结果,也可能是缺少词库。设置产出标准,不合格就切换或者兜底。
terranboy
6 月 20 日
可以先用 LLM 把词库抽出来,人工校验, 每次翻译不停优化词库,只会越来越好;另外你是不是遇到大文本的问题了,得分段
TsubasaHanekaw
6 月 20 日
分章节,让子任务阅读,提取人物信息,然后写翻译表。
teli
6 月 20 日
@kuhung 应该不是缺词库。
有些原文,本身就写得不清不楚,或者过于抽象。人翻译起来都头疼。几个 LLM 遍历下来,可能一个对头的都没有。
然后就应该属于你说的随机性了。可能出现神来之笔;可能明明简单的东西,就是给你来点小错误。

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1221605

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX