关于使用agent机翻的未来与个人看法(随笔)

个人随笔
423
瑜瑜
瑜瑜

800

最近大概是7月左右涌现出了一大批的使用agent进行翻译的补丁,再加上B站上的一些up的视频大多数人都应该有了一定的了解,下面说说我个人的看法与些许建议,纯主观
在具体开始之前我说说自己对于ai迅速发展带来了什么吧,我觉得最大影响的一部分就是在coding上,现在对于自身写代码的要求大大的降低了,但是这能帮助一个什么都不懂的人去做好gal程序吗,我个人算是不看好的,或者说现在agent的能力还不至于完美的处理好这部分,ai相当于是一个知识面足够全面的coding手,但是他做不到在某一个专项内达到顶尖的程度,如果使用者自己都不知道应该分析什么、验证什么,那agent很多时候也只能根据有限的信息不断猜测,这一部分相当需要使用者的指引,如果使用者能明确的告诉ai该做什么,该分析什么,该怎么操作怎么处理一部分的操作,不至于让ai像无头苍蝇一样的胡乱猜测,那么相信最后能达到一个事半功倍的效果大概也是写这篇文章的目的
流程其实比较固定解包,提文本,回注,有字库的多处理一个字库没字库的想改gbk的改gbk,想做日繁的做日繁,只重点讲文本的预处理上
首先我不提倡所有的直接把文本丢给ai让他直接翻译的行为,进制类bin文件可能还好,最忌讳的就是把明文直接丢给ai翻译,ai不知道到底哪些地方是需要翻译,哪些地方不用翻译,包括译后的一些处理,全角化这些小地方的讲究非常多
大概能用上的工具winhex,vscode,ida/ghidra这些的逆向软件
写到这里的时候其实才突然意识到,所有的操作似乎到这里就已经结束了,用ida导出反汇编,然后丢给ai写提取注入然后再结束了
那就说点别的东西吧,krkr一整个dataxp3包的一般都有补丁包逻辑,还有一些引擎也是单独一个大包,在做之前优先检查有没有免封包/补丁包逻辑,BGI/FFA等等的都有
提取的话建议让ai提成name--message json或者txt格式然后用**SExtractor** 进行二次提取,正则就
05_search="name": "(?P<name>.+)"
30_search="message": "(.+)"
翻译还是更推荐用**GalTransl** GalTranslPP 这类的翻译器,就目前而言还是不推荐直接在codex等agent软件里面进行翻译
全角化,有些引擎并不支持半角字符,建议在完整翻译进去之前先测试下半角字符的兼容性,有些会导致后续同句内容错乱,有的会导致报错,nscript这引擎就这样的
字典,翻译之前可以用codex此类agent软件跑一个项目字典,避免人名译成千奇古怪的东西
agent到底带来了什么呢,带来的实际上是对于陌生引擎的分析成本,过去更多就是garbro先拆,然后去github上找有没有对应引擎的工具,有的话那就直接用,没有的话那基本就歇逼了,只有少数的人掌握技术去生产工具,agent带来的就是工业浪潮,就好像第一次工业革命给人类带来了工业化生产,如今agent的到来也给想要自己做翻译的游戏带来了工具,发出指令的人就是boss,而agent成为了工人(笑),但我依然不认为就可以丧失寻找工具,检索的能力,毕竟省下来的token可以用来做更多没人做的引擎

本文版权遵循 CC BY-NC 协议 本站版权政策

7 条回复

anjila
发布于

其实关于agent机翻我就关心一件事他有没有玩完他自己汉化完成的gal 我对一些趁着热度ai翻译完就发布的人嗤之以鼻 毕竟ai现在翻译的确实不错 但是上下文长了他必然会出问题 (吐槽:我这里有个ai逆向工程在长时间工作后出现了严重的降智 他连怎么抓包命令都会出错了啊啊啊啊啊啊) 不说了 我去看工作怎么样了 (但不过逆向gal就有点烧Tokens 我之前去让他解包cocoro就告诉他我电脑里有些工具和让他联网查资料 然后我躺了床上了起来一看他烧了1.2亿Tokens 我的钱包!!!!!! 然后也没解出什么东西 我就让他停了)

瑜瑜
发布于

@anjila #1 其实你这种情况就是我一直担心的,什么都不说,就和ai说一句帮我解包xxx,要是引擎有对应的开源项目那还好说,要是没有那就只剩ai对着二进制文件大力出奇迹了,在我目前感受到的是人必须告诉ai要怎么做,甚至人工来帮ai做一些预处理之类的事情,说白了就是人要来给ai充当大脑带着他去思考,而不是说有了ai就可以丢掉大脑

甚至有时候为了矫正ai理解上的一个错误能和他争的面红耳赤,就比如我前两天做的一个字库相关的东西傻逼ai一直和我说xxx行不通,后面我一想他就是傻逼,字符的索引表从始至终都没有改变,根据索引从字库反向取字就可以做到得出映射表,但是没有人的提醒ai根本注意不到什么是变的什么是不变的,甚至一直和我说只有ocr才能得出结论,假设你作为一个小白什么都不懂的情况下就是很容易被ai牵着鼻子走

并且有了更强的ai也不代表一句话让人工智能帮我汉化一个游戏就能成立,至少目前展现出来的我是持悲观态度的

anjila
发布于

@瑜瑜 #2 并不是什么都不说哦 而且我也有工具只是懒得去用 我是看他有反编译的skill和我电脑的反编译工具才开始的 我也说了可以下载工具和查资料 只是 我用的agent(dsh)不和OpenClaw一样有第一时间上网寻找的问题的问题 不过吗 第一次用 就这样咯

在日
发布于

我个人或许就是你说的那种完全都不懂的人做汉化的例子吧,我真的代码完全不懂,基本上全靠网页版的GPT Sol从零指导我汉化,我先把文件目录发给Sol,然后Sol一步一步指导我怎么做,怎么去GitHub下东西,下完的东西怎么用,终端里运行哪些东西,哪些文件哪些输出发给他等等,然后他提出一个codex运行的文本翻译方案,我就完全按他说的做就行了。其实最关键的是他能指导我直接去下哪个工具以及工具怎么使用,至于翻译,也是他来给codex提示词,然后给我一大堆py文件来转换和审之类的。

不过我还真按这个流程做出几部汉化了,上个月汉化了一部160万字110CG的超级大拔作和一部几小时短篇,另外补充了某个新发布的更新版游戏的汉化和修复了bug,除了那部超级大拔作外我都从开头推到结束测试过了(与其说是测试其实应该说游玩😀)

其实这件事是源自我最开始的一个想法,把自己正在推的gal的文本全部提取出来,然后发给AI看,让ai全程指导我游玩,包括玩之前分析这部是不是适合我,中途给出下一个Hscene预计时间好让我及时加热飞机杯,结尾玩完了一起讨论剧情之类的等等,超级有意思的!!!

瑜瑜
发布于

@anjila #3 但其实完全没必要啊,cocoro这部是krkr引擎的,用现有的工具来说完全可以解决,就像我文章里面说的最后一句话agent的到来不代表就可以丧失寻找工具,检索的能力

瑜瑜
发布于

@在日 #4 这种就仁者见仁智者见智,找到适合自己的workflow就好了,人的知识是用来在ai方向错误的时候用来进行修正,if不能拴住ai只能越偏越远了()

在日
发布于

@瑜瑜 #6 我感觉反复试反复给反馈就挺好的,GPT Sol也会经常纠正自己的错误方向,其实我大部分时间用的是聊天模式的Sol,工作模式都不怎么用,基本不怎么消耗额度,可以聊一整天

(。>︿<。) 已经一滴回复都不剩了哦~