@chasedream1129 在 想问问用哪些模型做翻译效果最好,正在做重视质量的塞尔达旧作汉化 中发帖

目前的思路是:将输入的原始文本结构化,尽量从数据角度多挖一些背景上下文(理想情况是出现位置、说话人等,但老游戏+逆向挖不出来那么多信息…基本只有index:content的键值对了),再辅以术语库,交给多个LLM进行初翻,由旗舰模型(目前只有条件用astra,没A/的号)进行裁决,最终人工审校 
随着Agent能力的增强,现在出现了非常多的AI汉化,但大多都还局限在单一模型甚至直接让干活的agent来翻译,质量良莠不齐。私认为这套思路跑通后,还可以完善一下,开源给其他汉化人员使用?
但在LLM选型上目前还没拿定主意
在机器翻译专用模型方面,本地部署了Hy-MT2-30B-A3B Q4KM,但尚不清楚翻译专用模型的质量是否会好于旗舰模型
考虑选旗舰国模(4.1flash/qwen3.8max?)以及基础外模luna(grok和gemini没用过也没号)
曾听闻gpt-4o最会说人话,但...