把掃描件(沒有文字層的 PDF)辨識成文字,輸出可以直接編輯的 .docx。原本就有文字層的 PDF 會直接抽字,不重跑辨識。
🔒 全程在這台裝置的瀏覽器裡運算,檔案不會上傳,也沒有任何對外連線
尚未選擇檔案
掃描件的文字層通常是空的,自動判斷就會改走 OCR。
語言愈少載入愈快、也比較不會認錯。
先拿一兩頁試辨識效果,再整份跑,比較省時間。
辨識不準時先把解析度調高,通常比換語言有效。
手寫、蓋章、髒污處辨識一定爛。略過的行會留下「未轉出」標記, 不會整行無聲消失——清冊少一列沒人會發現。
OCR 一定會有錯字,這裡可以直接改。下載的內容以這個框裡的文字為準;
===== 第 N 頁 ===== 那幾行是分頁位置,刪掉就不會分頁,一行文字就是 Word 裡的一段。
⚠️ 有文字層的 PDF 用的是辨識當下的結果, 你在上面預覽框改的字不會反映到它裡面(那層文字是貼在原圖對應位置上的,改不動)。 要改字請用 Word 檔。
| 頁 | 來源 | 辨識信心 | 字數 |
|---|