所有工具

把掃描 PDF 轉成可搜尋 PDF

用 Tesseract.js Web Worker 在瀏覽器辨識掃描 PDF,建立保留頁面影像且具有隱藏文字層的可搜尋 PDF,也能同步下載 TXT。

選擇掃描 PDF檔案不會上傳,資料只留在你的裝置上
01

使用方法

  1. 選擇掃描 PDF,設定頁碼、辨識語言與 DPI。
  2. 首次使用時等待瀏覽器下載並快取 OCR 語言模型。
  3. 完成辨識後下載可搜尋 PDF,必要時一併下載 TXT。
02

實用建議

  • 150 DPI 在速度、記憶體與辨識率間較平衡。
  • 一次最多處理 40 頁;多頁 PDF 分批處理能降低 OOM 風險。
  • 掃描越清楚、方向越正確,OCR 結果通常越好。
03

常見問題

支援哪些語言?

目前提供英文、繁體中文、簡體中文、日文與韓文模型。

PDF 會傳給 OCR 服務嗎?

不會。瀏覽器只下載公開語言模型,頁面影像與辨識內容都留在本機 Worker 中。