跳过主要内容
全部文章对比

2026 年漫画翻译哪个 AI 模型最好:6 个模型 46 页实测

2026 年翻译漫画最好的 AI 模型是哪个:我们把同样的 46 页漫画交给 6 个模型,从 GPT-6 到 Gemini 和 Claude Opus,数出每个模型翻错了几句。

Serifu · · 7 分钟阅读

一格漫画,旁边是 6 个 AI 模型对同样两句写出的译文,每个都标了对或错

在我们 2026 年 10 月的测试里,翻译漫画最好的 AI 模型是 gemini-3.8-flash 和 claude-opus-5-5:46 页下来,两个都没有明显的错误。 gpt-6-sol 有 1 处,gpt-6-luna 有 3 处,claude-sonnet-5-5 有 5 处,claude-haiku-5-5 有 9 处。模型更大,翻译不一定更好:一个轻量模型赢了一个中型模型。

我们做的是漫画翻译器 Serifu,2026 年 10 月 10 日做了这次测试。测试没有任何人赞助。

模型46 页里明显的错误每页用时(秒)Serifu 里有没有
gemini-3.8-flash0约 15有
claude-opus-5-5010 到 20,有时超过一分钟有
gpt-6-sol1约 7没有
gpt-6-luna3约 8有,默认模型
claude-sonnet-5-55约 7没有
claude-haiku-5-59约 6没有

测试是怎么做的

  • 页面: 46 页,278 句:佐藤秀峰《ブラックジャックによろしく》第 1 卷的 35 页(日语,允许自由二次利用),이호윤 的韩国条漫《동백꽃》的 9 页(CC BY),还有 2 页繁体中文的漫画。全部翻译成英语。
  • 分两轮: 第一轮是 25 页普通的页面。第二轮是 21 页专门挑出来的、翻译时容易出错的页面,而且在任何模型运行之前,就先写下了正确的译文必须做到什么。
  • 每个模型做的事一样: 每个模型拿到的都是各句的文字、这一页的图、前面两页,以及同一份要求:译得像正式出版的英文版那样。每个模型只跑一次,结果一字不改,思考都设在低或关闭。
  • 什么算错: 意思错了,人或性别错了,人名或术语被改坏了,或者有词没翻译。语气平淡一点或活泼一点不算错。

46 页只跑一次,能看到的是我们遇到的这些错误,不是错误率。下面每张图,都是页面上的那一部分,旁边是每个模型写的译文,一字不差。

页面上的人是谁

日语经常省略「他」和「她」。这一页的病人是女性,只有画面能看出来。两个 GPT-6 模型都写成了「him」(他);另外 4 个是从画面上读出来的。

病人是女性:gemini、opus、sonnet 和 haiku 写「her」,gpt-6-sol 和 gpt-6-luna 写「him」

一句话,两个对话框

漫画会把一句话拆进几个对话框,每个对话框里要放它自己的那一半。gpt-6-luna 在两个对话框里都写了整句。

一句话拆在两个对话框里:5 个模型拆开了,gpt-6-luna 在两个里都写了一遍

必须前后一致的名称

第一外科这个科室,在同一页上出现了两次。claude-sonnet-5-5 第一次写成「General Surgery」(普通外科),第二次写成「First Surgery」(第一外科);claude-haiku-5-5 两次都漏了「First」。

同一个科室出现两次:sonnet 先写「General Surgery」再写「First Surgery」,haiku 写「my surgery department」

剂量和药名

一名住院医师报告:肝素每小时 800 单位,还用了一种叫 Millisrol 的药。claude-haiku-5-5 漏了「an hour」(每小时),还把药名拼成了「Milislon」。其他 5 个都对。

一句医疗方面的话:5 个模型都对,haiku 漏了「an hour」,药名也拼错了

方言

那部韩国条漫的故事发生在山村,人物说的是江原道方言。有人问「你一个人干活吗?」,少年顶了回去:当然一个人,难道还一大群人一起干?两个 Claude 模型把这句顶嘴的话译反了。

一句江原道方言:4 个模型对,sonnet 和 haiku 译反了

同一个故事里还有一句老式的骂人话,骂人生下来就是傻子。claude-haiku-5-5 把它当成了人名「Bennet」;gpt-6-luna 写成了「impotent」(性无能)。没有模型拒绝翻译这一句。

一句出自 1936 年小说的骂人话:haiku 读成了人名,gpt-6-luna 写成「impotent」

日语那边,一家从九州来的人用家乡的方言向外科医生道谢。6 个模型意思都对。其中 3 个在英语里还保留了乡下人说话的口气:claude-opus-5-5、gemini-3.8-flash 和 claude-sonnet-5-5。

一句九州方言:每个模型意思都对;opus、gemini 和 sonnet 保留了乡下人说话的口气

拟声词

「ハァ」是一声叹气。claude-sonnet-5-5 给一个站着不动的男人写了「Pant」(喘气声)。

拟声词「ハァ」:3 个模型写「sigh」,sonnet 写「Pant」

一句双关,和一种和名字对不上的花

这两处没有给任何模型算错,因为没有唯一正确的译法。

一个喝醉的男人口齿不清,把「对身体不好」说着说着说成了「肝脏」这个词。gpt-6-luna 用「It's ba-ad for your li-ver」把两层意思都留住了;gpt-6-sol 和 claude-opus-5-5 各自写了一个英文的双关。

「对身体不好」和「肝脏」的双关:每个模型的译法

条漫标题里的花「동백꽃」,在一般的韩语里是山茶花。在故事的方言里,它指的是开黄花的三桠乌药,韩语叫「생강나무」(生姜树)。5 个模型写了「yellow camellias」(黄色的山茶花)。只有 gemini-3.8-flash 写了「yellow ginger flowers」(黄色的生姜花)。

노란 동백꽃:5 个模型写「yellow camellias」,gemini 写「yellow ginger flowers」

每一处错误

  • gpt-6-sol(1 处): 把女病人写成「him」。
  • gpt-6-luna(3 处): 把女病人写成「him」;一句话在两个对话框里各写了一遍;把那句骂人话写成「impotent」。
  • claude-sonnet-5-5(5 处): 把第一外科写成「General Surgery」;把方言里顶嘴的那句译反;在少年的心里话里加了半句他根本没想过的话;把「ハァ」写成「Pant」;把灯一闪一闪的「チカ」写成「Click」。
  • claude-haiku-5-5(9 处): 把骂人话当成人名;方言里顶嘴的那句;有两句把谁做了什么弄反了;「my surgery department」;肝素那一句;把含糊嘟囔的「モゴ」写成「sob」;一闪一闪的灯原样留成了「Chika」;一句医生的心里话。

Serifu 提供其中哪些模型

在 Serifu 里,每个项目用哪个翻译模型由你来选:gpt-6-luna(默认)、gemini-3.8-flash 或 claude-opus-5-5。不管选哪个,翻译完以后每一句都还能改,也可以换一个模型重新翻译这一页或重新翻译这一句。见积分和价格。

直接把页面交给 ChatGPT、Claude 或 Gemini 行不行?

只说文字,行:它们就是同样的这些模型,在这次测试里大部分句子都译对了。结果好不好取决于三件事,而在聊天里,这三件事都得你自己来。

  • 模型看到什么: 这次测试里,每个模型拿到的都有这一页的图和前面两页,不只是文字。没有图,就没有任何地方说病人是女性;没有前面的页,人名和谁在说话就会走样。
  • 名称从头到尾一致: 一卷可能有 200 页。一个科室、一个外号、一个人物的名字,在第 150 页必须和第 5 页一样,这需要一份贯穿整本书的术语表。
  • 把字放回页面上: 聊天给你的是文字。页面还得一个对话框一个对话框地去字、嵌字。

漫画翻译器替你做这三件事。Serifu 识别每一页上的文字,连同这一页、前面两页和你的故事、人物、术语表一起发给你选的模型,再把译文嵌回对话框里。每一句都能改,整卷可以导出为 CBZ、PDF 或图片。见在网页上翻译。

常见问题

ChatGPT、Claude 或 Gemini 能翻译漫画吗?

像这次测试一样,把页面和前面的页一起给它们,文字它们译得不错。但它们还给你的是文字,不是嵌好字的页面:去字、把译文嵌进对话框是另一件事,也就是漫画翻译器做的事。

翻译漫画用哪个 AI 模型最好?

在我们 2026 年 10 月 6 个模型、46 页的测试里,gemini-3.8-flash 和 claude-opus-5-5 没有明显的错误。gpt-6-sol 有 1 处,gpt-6-luna 有 3 处,claude-sonnet-5-5 有 5 处,claude-haiku-5-5 有 9 处。

越大的 AI 模型,翻译得一定越好吗?

不是。claude-sonnet-5-5 是它那一家的中型模型,错了 5 处;gemini-3.8-flash 是轻量模型,一处没错。更大的 claude-opus-5-5 也一处没错,所以模型大有时有用,有时没用。

日语漫画翻译成英语,Claude 和 GPT 哪个更好?

要看具体是哪个模型,不是看哪一家。Claude Opus 5.5 属于最好的,Claude Haiku 5.5 最差;两个 GPT-6 模型里,sol 错 1 处,luna 错 3 处。

AI 模型翻译漫画会错在哪里?

在这次测试里:日语没写明时一句话说的是谁,拆在几个对话框里的一句话,必须前后一致的名称,药名和剂量,方言,还有拟声词。

模型需要看到页面,还是只给文字就行?

需要看到页面。在女病人那一页,文字里没有任何地方说她是女性;译对的模型都是从画面上读出来的。