# 掃描版 PDF 怎麼轉成適合手機閱讀的 EPUB？

從掃描質量、文字識別到段落重排，梳理 PDF 轉 EPUB 的準備步驟與驗收方法，避免只換格式卻沒有改善閱讀體驗。

掃描書在電腦上看起來很清楚，放到手機上卻可能需要不斷放大、左右拖動。問題往往不在螢幕，而在檔案仍然圍繞固定頁面組織。把掃描 PDF 轉成 EPUB 的價值，是讓識別後的文字適應閱讀視窗，而不只是把副檔名換掉。

## 先確定你要保留什麼

PDF 適合保留固定頁面，流式 EPUB 更適合調整字號後繼續閱讀。[EPUB 標準](https://www.w3.org/TR/epub-33/)也允許固定版式，因此不能僅憑副檔名判斷一本書是否可以自由重排。

小說、以正文為主的教材，通常更看重閱讀連貫性；插圖與標註位置緊密關聯的手冊，則應保留 PDF 作為參照。畫素級還原和流式閱讀是不同目標，轉換前先選定優先順序。

## 判斷原始檔需要哪些處理

嘗試選中一段文字：如果只能選中整塊圖片，通常需要 OCR。即便能選擇文字，也要複製一段檢查是否亂碼、缺字或順序混亂。已有文字層並不代表文字層可靠。

至少檢查章節開頭、普通正文、最複雜的一頁。注意書脊陰影、傾斜、裁掉的頁邊、模糊小字和跨頁段落。優先使用清晰原件；單純放大低解析度圖片不會自動找回已經丟失的細節。

## 先用有代表性的檔案試轉換

在 [PDF Craft 轉換頁面](https://pdfcraft.ai/zh-Hant/pdf-craft/)選擇 EPUB 輸出。先處理一個較短但包含典型難點的檔案，再決定是否處理整套資料。書裡有腳註、表格或公式，樣本里就應包含這些元素，不要只用封面驗證。

PDF Craft 將識別和文件轉換放在同一流程中，目標是得到可以繼續閱讀的產物，而不是一份鬆散的文字堆積。掃描質量和複雜排版仍會影響結果，不能把“任務完成”理解成“識別完全正確”。如果目的是編輯段落和整理筆記，可以先看 [PDF 轉 Markdown 指南](https://pdfcraft.ai/zh-Hant/blog/pdf-to-markdown-for-research/)。

## 在實際閱讀器裡驗收

開啟 EPUB，調大字號、縮小視窗，檢查段落能否自然重排。檢視目錄是否能定位到對應章節，標題有沒有混入正文，插圖及說明是否仍能一起理解。

對照原 PDF 讀過一處分頁位置，特別留意頁首重複、跨頁斷詞、多欄序列以及腳註標號錯配。建議逐項確認：

- 抽查章節的開頭和結尾都在。
- 段落順序和原書一致。
- 關鍵人名、數字、符號沒有明顯錯誤。
- 調大字號後不需要持續橫向滾動。
- 註釋與插圖仍能找到對應正文。

## 保留原件作為引用依據

流式排版會改變文字在螢幕上的位置，EPUB 頁碼不一定對應印刷頁碼。做摘錄時記錄原書版本和原 PDF 頁碼，不要只保留轉換後的閱讀位置。

如果樣本仍需要大量修正，先改善掃描質量或繼續使用 PDF，再投入整本書的處理。技術類資料可以繼續使用[公式與腳註檢查清單](https://pdfcraft.ai/zh-Hant/blog/check-formulas-footnotes-after-ocr/)。好的轉換結果，應當既讀得下去，也查得回原文。
