使用方式
- 選擇一份 PDF 或多張圖片,選擇繁中、英文或混合模型。
- 第一次先準備模型,再設定頁面、DPI、版面模式與影像前處理。
- 逐頁檢查信心度並修正文字,最後匯出 TXT、Markdown、JSON 或可搜尋影像 PDF。
隱私
輸入與檔案直接在目前瀏覽器分頁中處理。除非你自行使用其他服務分享結果,Mingmist 不會接收內容。
限制
一次最多 80 頁/張圖片,並以單一 Worker 依序處理以降低記憶體風險。Tesseract.js 不直接解析 PDF,因此工具先以 PDF.js 渲染頁面。可搜尋 PDF 會影像化頁面,失去原始文字、連結、表單、附件、註解與數位簽章;校正後文字只套用於文字匯出,不會重新計算字詞座標。
常見問題
檔案會被上傳嗎?
不會。PDF 與圖片只在目前瀏覽器分頁處理;首次使用下載的是 OCR 執行資源與語言模型。
為什麼第一次比較慢?
OCR 核心與繁中/英文語言資料需要先下載。Tesseract.js 會把語言模型保存在瀏覽器 IndexedDB,Service Worker 也會按需快取執行資源。
可搜尋 PDF 為什麼需要字型?
PDF 標準字型無法編碼中文。辨識結果含非拉丁字元時,必須由使用者提供支援該字元的 TTF 或 OTF 字型。
可以保證辨識正確嗎?
不能。掃描品質、字型、表格、直排、多欄與手寫都會影響結果,重要內容必須人工校對。