上傳一張條漫,幾十秒後拿到中文版。中間那幾十秒裡,其實發生了四件獨立的事。
知道這四步分別在做什麼,有個實際好處:翻出來的結果不對時,你能判斷是哪一步壞了,而不是只能得出「這工具不行」的結論。有些問題換工具解決不了,改一下來源圖就好。
實際的操作流程可以先看 韓漫機翻怎麼做?韓文網漫翻譯完整指南,這篇談的是那個流程背後發生了什麼。
第一步:找出文字在哪,並讀出來
這一步通常叫 OCR,但用在漫畫上的 OCR 和掃描文件的 OCR 差很多。
掃描文件的文字排列整齊、背景乾淨、字體單一。條漫不是。文字可能在氣泡裡,可能疊在背景上,可能是手寫風格的字體,可能歪斜或帶陰影。
所以漫畫用的處理通常分兩層:先判斷哪些區域是文字,再讀出那些區域寫了什麼。第一層叫文字偵測,第二層才是辨識。
條漫在這一步的難處是長圖。一張幾萬像素的直向圖片,如果直接縮小到模型能吃的尺寸,文字就糊了;如果切開處理,切點可能剛好落在一個氣泡中間。切分策略做得好不好,結果差很多。
你能控制的部分: 來源圖的解析度。從網頁上縮小顯示的狀態截圖,文字本身就已經糊了,後面幾步再怎麼做都救不回來。用原始尺寸存圖是最有效的一步。
第二步:翻譯
讀出文字之後才輪到翻譯。這一步看起來最單純,實際上有兩個條漫特有的陷阱。
上下文的範圍。 一句一句單獨翻,和帶著前後文一起翻,結果差很遠。韓文常常省略主詞,「갔어」這句話沒有上下文就只能翻成「去了」,但到底是誰去了,要看前一句。條漫的對話往往橫跨好幾張切片,切得太碎,上下文就斷了。
語氣和稱呼。 韓文的敬語體系比中文細,해요체 和 해체 的差別在中文裡沒有直接對應。機翻常常一律處理成平語,角色之間的上下關係就消失了。오빠、선배 這類稱呼也一樣,直譯往往不自然,要看關係和場景決定怎麼處理。
你能控制的部分: 不多。這一步主要看工具本身的模型和上下文處理方式。但如果發現語氣普遍不對,通常不是你的操作問題。
第三步:修圖
翻譯好了,接下來要把原本的韓文從圖上拿掉。
拿掉之後會留下一塊空白,而那塊空白下面原本是有東西的:氣泡的白底、網點、背景的線條、人物的頭髮。修圖要做的就是把這塊區域補回去,讓它看起來像原本就沒有文字。
氣泡內的文字最好處理,因為底下是純白,補起來幾乎看不出痕跡。
壓在背景上的文字最難。要補回去的是複雜的圖案,補得不好就是一塊糊掉的色塊,這是「翻譯後畫面被毀掉」最常見的來源。
狀聲詞是另一個問題。 條漫的狀聲詞經常是設計過的圖形,本身就是畫面的一部分。全部拿掉會破壞構圖,全部留著讀者又看不懂。比較合理的處理是對白優先,背景效果音保留原樣。
你能控制的部分: 避免使用重複壓縮過的圖。JPEG 反覆存檔會產生雜訊,雜訊會讓修圖的邊界判斷變差。
第四步:嵌字
最後一步是把中文放回去,這一步決定成品看起來專業還是廉價。
要處理的問題包括:中文字數和韓文原文不一樣長,氣泡大小是固定的,字太大塞不下,字太小又難讀。換行要落在合理的位置。字體要符合情境,吶喊和低語不該用同一種字重。
條漫在這一步反而比日漫容易一些,因為條漫以橫書為主,不用處理直書排版。日漫的直書氣泡換成中文後怎麼排,是另一個麻煩得多的問題。
但條漫有自己的難處: 氣泡形狀比日漫更自由,圓的、爆炸狀的、不規則的都有,文字要貼合形狀排進去並不容易。
漢化組花最多時間的通常就是這一步。嵌字做得好不好,是機翻成品和人工漢化之間最明顯的差距。
出問題時怎麼判斷是哪一步
症狀 | 多半是哪一步 | 怎麼處理 |
|---|---|---|
有些文字完全沒被翻到 | 第一步偵測沒抓到 | 檢查解析度,或把長圖切開 |
文字翻了但意思不通 | 第二步上下文斷了 | 切片不要太碎 |
語氣或稱呼很怪 | 第二步 | 工具本身的限制 |
氣泡周圍一塊糊掉 | 第三步修圖 | 換沒有重複壓縮的來源圖 |
中文擠在一起或跑出氣泡 | 第四步嵌字 | 工具本身的限制 |
後半段整段沒處理 | 第一步切分 | 長圖切開再上傳 |
會發現一個規律:前兩步的問題你多半能自己改善,後兩步主要看工具。所以遇到問題時,先檢查來源圖,再考慮換工具。
為什麼通用翻譯工具在條漫上表現差
看完這四步就清楚了。通用的圖片翻譯工具(Google 翻譯的相機功能、各種截圖翻譯)通常只做第一步和第二步,而且是用一般照片的標準去做。
它們沒有修圖,所以譯文是疊在原文上面,底下的韓文還在。也沒有真正的嵌字,只是把文字框畫在圖上。條漫的長圖更是超出它們的處理範圍。
所以不是那些工具做得差,是它們本來就不是為這個場景設計的。AI 漫畫翻譯器 針對的就是後面兩步,這是專用工具和通用工具的主要差別所在。
常見問題
為什麼同一部作品,有些話翻得好有些話翻得糟?
多半是來源圖的品質不一致。不同話的圖可能來自不同的存檔方式,解析度和壓縮程度不同,第一步和第三步的結果就會有落差。
修圖會不會把畫面改壞?
氣泡內的文字幾乎不會有問題。壓在複雜背景上的文字風險較高。如果很在意畫面完整度,可以比對原圖確認。
狀聲詞為什麼沒有全部翻?
因為它們是畫面的一部分,全部替換會破壞構圖。這是取捨,不是漏掉。
一次可以處理多少?
單張圖片上傳一次最多 200 頁,打包成 ZIP 則沒有頁數限制。不註冊可以先翻譯 5 頁,註冊後再送 5 頁,合計 10 頁免費額度。
小結
機翻不是一個動作,是四個步驟接力。偵測讀字、翻譯、修圖、嵌字,每一步都可能單獨出錯。
實際遇到問題時,先看症狀落在哪一步。來源圖的解析度和壓縮狀況能解決掉一大半問題,剩下的才是工具本身的差異。
至於機翻成果可以用到什麼程度、哪些做法會越界,整理在 機翻漫畫合法嗎?個人使用的界線在哪。