轉檔
把掃描件(沒有文字層的 PDF)辨識成文字,輸出可以直接編輯的 .docx。原本就有文字層的 PDF 會直接抽字,不重跑辨識。
🔒 全程在這台裝置的瀏覽器裡運算,檔案不會上傳,也沒有任何對外連線
尚未選擇檔案
掃描件的文字層通常是空的,自動判斷就會改走 OCR。
語言愈少載入愈快、也比較不會認錯。
先拿一兩頁試辨識效果,再整份跑,比較省時間。
辨識不準時先把解析度調高,通常比換語言有效。清冊那種小字,200 dpi 常常會把「3」看成「8」。
手寫、蓋章、髒污處辨識一定爛。略過的行會留下「未轉出」標記,
不會整行無聲消失——清冊少一列沒人會發現。有格線的表格也常在行首行尾多出
| - 之類的雜字,開這個門檻可以濾掉一部分。
OCR 一定會有錯字,這裡可以直接改。下載的內容以這個框裡的文字為準;
===== 第 N 頁 ===== 那幾行是分頁位置,刪掉就不會分頁,一行文字就是 Word 裡的一段。
⚠️ 有文字層的 PDF 用的是辨識當下的結果, 你在上面預覽框改的字不會反映到它裡面(那層文字是貼在原圖對應位置上的,改不動)。 要改字請用 Word 檔。
| 頁 | 來源 | 辨識信心 | 字數 |
|---|