本機 OCR 工作區

在瀏覽器內辨識掃描 PDF 與圖片,校正文字並匯出 TXT、Markdown、JSON 或可搜尋影像 PDF。

本機處理保留原始檔可直接匯出

工具工作區

處理權限留在目前分頁
PDF 與圖片不可混合選取。檔案只在目前裝置處理。

尚未選擇檔案。

01

頁面與版面

控制渲染解析度、頁面範圍與文字排列方式。

02

影像前處理

前處理只用於辨識;可搜尋 PDF 仍使用原始彩色頁面。

等待開始

校正與輸出

文字匯出會採用你校正後的內容;可搜尋 PDF 使用 OCR 字詞座標。

建立可搜尋影像 PDF

每頁會影像化,再加入幾乎不可見的 OCR 文字層。原始連結、表單與數位簽章不會保留。

字型只在目前分頁讀取並嵌入輸出 PDF,不會上傳或保存。
LOCAL
模型與檔案分開管理

PDF/圖片不會送到模型供應站;首次使用只下載 OCR 執行檔與語言資料。語言模型由 Tesseract.js 儲存在瀏覽器 IndexedDB,外部執行資源則由 Service Worker 按需快取。

使用方式

  1. 選擇一份 PDF 或多張圖片,選擇繁中、英文或混合模型。
  2. 第一次先準備模型,再設定頁面、DPI、版面模式與影像前處理。
  3. 逐頁檢查信心度並修正文字,最後匯出 TXT、Markdown、JSON 或可搜尋影像 PDF。

隱私

輸入與檔案直接在目前瀏覽器分頁中處理。除非你自行使用其他服務分享結果,Mingmist 不會接收內容。

限制

一次最多 80 頁/張圖片,並以單一 Worker 依序處理以降低記憶體風險。Tesseract.js 不直接解析 PDF,因此工具先以 PDF.js 渲染頁面。可搜尋 PDF 會影像化頁面,失去原始文字、連結、表單、附件、註解與數位簽章;校正後文字只套用於文字匯出,不會重新計算字詞座標。

常見問題

檔案會被上傳嗎?

不會。PDF 與圖片只在目前瀏覽器分頁處理;首次使用下載的是 OCR 執行資源與語言模型。

為什麼第一次比較慢?

OCR 核心與繁中/英文語言資料需要先下載。Tesseract.js 會把語言模型保存在瀏覽器 IndexedDB,Service Worker 也會按需快取執行資源。

可搜尋 PDF 為什麼需要字型?

PDF 標準字型無法編碼中文。辨識結果含非拉丁字元時,必須由使用者提供支援該字元的 TTF 或 OTF 字型。

可以保證辨識正確嗎?

不能。掃描品質、字型、表格、直排、多欄與手寫都會影響結果,重要內容必須人工校對。