跳至主要內容

線上處理 PDF 與 EPUB

PDF Craft:掃描版 PDF OCR 與轉換

將掃描版 PDF 辨識為可搜尋、可編輯的 Markdown 或 EPUB,並盡量保留版面、公式、表格和閱讀結構。也支援翻譯 PDF 和 EPUB 電子書。

  • 公式、表格、複雜版面都能做 OCR
  • Markdown、EPUB 或翻譯後的 PDF 都能匯出

PDFEPUB 拖到這裡

將 PDF 轉換為 EPUB 或 Markdown。也可以翻譯 PDF 或 EPUB 電子書。

每次處理一個檔案

處理掃描版 PDF,最該看這 4 點

重點不只是把掃描件辨識成文字,而是把它整理成後面還能搜尋、編輯和繼續閱讀的內容。OCR 品質、版面保留和匯出可用性,都會直接影響結果。

  1. 哪些 PDF 最值得轉

    書籍、論文、教材、講義、雙欄排版,以及帶公式、表格、註腳的掃描件,都是這類能力最能拉開差距的情境。

  2. 最後拿到什麼

    你會拿到更適合搜尋、複製、校對和再加工的 EPUB 或 Markdown,而不是只看得見、改不動的圖片頁面。

  3. 轉完之後怎麼接著用

    先在桌面端檢查辨識和排版,再繼續匯出、歸檔或閱讀;如果想換裝置,也能在 iPhone 和 iPad 上接著看。

  4. 為什麼不只是基礎 OCR

    能把字認出來還不夠。真正可用的結果,還要盡量保住公式、表格、版面和閱讀順序,並方便後續搜尋、編輯和再加工。

桌面端 + iOS

轉換結束後,在本機繼續校對、閱讀和匯出

桌面端更適合處理掃描 PDF、檢查 OCR 結果和整理匯出;iOS 更適合隨手繼續閱讀。內容和閱讀記錄留在本機,同一個用戶端還能繼續開啟 EPUB、PDF、TXT、漫畫 ZIP 和 M4B。

EPUB PDF ZIP M4B
查看客戶端下載

常見問題

關於格式選擇、轉換結果和費用,按需查看。

EPUB 和 Markdown 應該選哪個?

希望以可調整字級的電子書形式閱讀,選擇 EPUB;需要編輯文字、繼續處理文件或準備知識庫內容,選擇 Markdown。兩者都不應被視為 PDF 版面的完全複製。

轉換後應該檢查哪些地方?

對照 PDF 檢查標題、段落順序和章節邊界。論文還應檢查雙欄閱讀順序、公式、表格和註腳。再次使用文字前,請修正辨識錯誤。

哪些情況會影響 OCR 品質?

掃描模糊、頁面傾斜、字級過小或版面複雜,都可能增加辨識難度。請保留原始 PDF,方便核對不確定的文字;任務完成不代表輸出沒有錯誤。

轉換費用和處理時間怎麼看?

目前計費方式請查看定價頁。處理時間會受到文件情況和服務負載影響,請以任務狀態為準,不要預設固定完成時間。

詳細指南:格式對照、檢查流程與參考資料

先選好輸出格式,再檢查文件中最重要的部分。OCR 辨識和版面重建可能產生錯誤,處理成功並不代表內容完全準確。

指南更新

怎樣按用途選擇輸出格式?

輸出格式與用途下載後重點檢查什麼?
EPUB:連續閱讀與調整字級用目標閱讀器開啟檔案,調整字級,檢查目錄能否定位章節、段落是否順序連貫。原 PDF 的頁碼和分頁可能不適合重排後的內容,引用原文時請回查原件。
Markdown:編輯與後續處理在實際使用的編輯器或知識庫流程中檢查標題層級、列表和圖片引用。核對公式、表格中的數字與單位,再決定如何切分段落;純文字可讀取不等於語意和結構已準確還原。

一次轉換應該怎樣完成檢查?

  1. 先檢查原件:挑選包含正文、表格或公式的代表性頁面,記錄最需要保留的資訊,並保留原 PDF 供對照。不要只根據封面判斷整份文件的掃描品質。
  2. 按閱讀或編輯用途選擇輸出格式並提交任務。以任務列表中的實際狀態為準;若任務失敗,記錄錯誤訊息後再處理,避免在原因不明時反覆提交同一檔案。
  3. 下載後先核對代表性頁面,再檢查章節之間是否有漏段、重複或順序顛倒。將不確定的字元、數值和註腳與原件逐一對照,完成修訂後再用於引用或知識庫。

這些格式說明依據什麼?

W3C 的 EPUB 3.3 規範將 EPUB 定義為數位出版物的分發與交換格式。它描述出版物的封裝和閱讀結構,並不保證某個轉換工具的識別或翻譯品質。

W3C:EPUB 3.3 規範

distribution and interchange format for digital publications and documents

W3C 原文摘錄

CommonMark 可用於理解 Markdown 的基礎語法。表格、公式等擴充的呈現還取決於你使用的編輯器或後續處理工具。

CommonMark:Markdown 語法規範