Belin Doc IconBelin Doc

PDF 怎麼翻譯:五個步驟完整流程

文字版、掃描檔、三百頁的大檔案,都走同一套五步流程。第一步決定最後成果,而多數人剛好跳過它。

更新於

#PDF 怎麼翻譯
#PDF 翻譯步驟
#掃描檔翻譯
#文件翻譯

快速答案

PDF 翻譯分五步:先判斷檔案屬於哪一類,再設定語言對、挑模型、開始翻譯,最後只檢查四個位置。第一步決定後面所有環節——文字版 PDF 與掃描檔要走完全不同的路,把掃描檔當文字版處理,正是譯文出錯的起點。

第一步:先判斷檔案是哪一類

檔案類型怎麼判斷代表什麼
文字版 PDF能用游標選取內文句子文字可直接擷取,風險只在結構
掃描檔 PDF選不起來,整頁就是一張圖必須先做 OCR 才談得上翻譯
帶 OCR 層的掃描檔選得起來,但反白和字有偏移檔案裡已有一層隱藏文字,正是譯後出現雙層文字的原因

動手之前,先試著選取一行內文。這三十秒能避開下面大半的麻煩。

第二步:設定語言對,挑好模型

  • 來源語言手動指定,別依賴自動偵測——中英夾雜的文件,自動偵測錯的次數比對的次數多
  • 依文件類型挑模型,而不是看跑分:見該用哪個 AI 模型
  • 若是掃描檔,開始前先確認流程包含 OCR:見掃描檔怎麼翻譯

第三步:先鎖住不該被更動的內容

  • 產品名稱、料號、法律用語,要在第一次翻譯前就進術語庫,而不是事後逐處修
  • 公式、單位、表格內的數字應原樣帶過:見怎麼保住公式
  • 檔案太大或上傳卡住,先拆分再傳,別反覆重試:見大檔案 PDF 怎麼翻譯

第四步:開始翻譯

上傳檔案,確認語言對與模型,然後開始。免費額度以頁數計算,不看檔案大小——見免費額度包含什麼。可以直接從 PDF 翻譯工具開始。

第五步:只檢查四個位置

不必通讀全文,看這四處就夠:

  • 表格之後的第一頁——閱讀順序最先在這裡亂掉
  • 任何分欄頁面——兩欄的句子被串成一句,是最常見的錯法
  • 一張含數字的表格——查數字,不查用字
  • 最後一頁——截斷總是出現在結尾

出問題時對照這張表

你看到的現象實際發生了什麼去哪裡解決
亂碼、段落順序錯亂解析階段結構就丟了PDF 翻譯為什麼會壞
文字互相疊在一起檔案裡殘留了隱藏的 OCR 層譯後出現雙層文字
整份檔案沒被翻譯頁面是圖片,OCR 沒跑起來掃描檔怎麼翻譯
上傳失敗或卡住一次處理不了這麼大的檔案大檔案 PDF 怎麼翻譯
譯文還需要繼續編輯PDF 本來就不是拿來編輯的格式PDF 轉 Word

相關工具

結論

PDF 翻譯的成敗,多半在按下「翻譯」之前就決定了:檔案是文字版還是掃描檔,結構能不能完整解析出來。這兩件事做對,再依四個位置抽查譯文,整套方法就是這樣。