快速答案
PDF 翻譯分五步:先判斷檔案屬於哪一類,再設定語言對、挑模型、開始翻譯,最後只檢查四個位置。第一步決定後面所有環節——文字版 PDF 與掃描檔要走完全不同的路,把掃描檔當文字版處理,正是譯文出錯的起點。
第一步:先判斷檔案是哪一類
| 檔案類型 | 怎麼判斷 | 代表什麼 |
|---|---|---|
| 文字版 PDF | 能用游標選取內文句子 | 文字可直接擷取,風險只在結構 |
| 掃描檔 PDF | 選不起來,整頁就是一張圖 | 必須先做 OCR 才談得上翻譯 |
| 帶 OCR 層的掃描檔 | 選得起來,但反白和字有偏移 | 檔案裡已有一層隱藏文字,正是譯後出現雙層文字的原因 |
動手之前,先試著選取一行內文。這三十秒能避開下面大半的麻煩。
第二步:設定語言對,挑好模型
- 來源語言手動指定,別依賴自動偵測——中英夾雜的文件,自動偵測錯的次數比對的次數多
- 依文件類型挑模型,而不是看跑分:見該用哪個 AI 模型
- 若是掃描檔,開始前先確認流程包含 OCR:見掃描檔怎麼翻譯
第三步:先鎖住不該被更動的內容
- 產品名稱、料號、法律用語,要在第一次翻譯前就進術語庫,而不是事後逐處修
- 公式、單位、表格內的數字應原樣帶過:見怎麼保住公式
- 檔案太大或上傳卡住,先拆分再傳,別反覆重試:見大檔案 PDF 怎麼翻譯
第四步:開始翻譯
上傳檔案,確認語言對與模型,然後開始。免費額度以頁數計算,不看檔案大小——見免費額度包含什麼。可以直接從 PDF 翻譯工具開始。
第五步:只檢查四個位置
不必通讀全文,看這四處就夠:
- 表格之後的第一頁——閱讀順序最先在這裡亂掉
- 任何分欄頁面——兩欄的句子被串成一句,是最常見的錯法
- 一張含數字的表格——查數字,不查用字
- 最後一頁——截斷總是出現在結尾
出問題時對照這張表
| 你看到的現象 | 實際發生了什麼 | 去哪裡解決 |
|---|---|---|
| 亂碼、段落順序錯亂 | 解析階段結構就丟了 | PDF 翻譯為什麼會壞 |
| 文字互相疊在一起 | 檔案裡殘留了隱藏的 OCR 層 | 譯後出現雙層文字 |
| 整份檔案沒被翻譯 | 頁面是圖片,OCR 沒跑起來 | 掃描檔怎麼翻譯 |
| 上傳失敗或卡住 | 一次處理不了這麼大的檔案 | 大檔案 PDF 怎麼翻譯 |
| 譯文還需要繼續編輯 | PDF 本來就不是拿來編輯的格式 | PDF 轉 Word |
相關工具
結論
PDF 翻譯的成敗,多半在按下「翻譯」之前就決定了:檔案是文字版還是掃描檔,結構能不能完整解析出來。這兩件事做對,再依四個位置抽查譯文,整套方法就是這樣。