PDF OCR 工具
免費線上 PDF OCR 工具,從掃描的 PDF 文件中提取文字。支援多頁 PDF 辨識,AI 智能處理。適合掃描文件數位化、文字搜尋。
上傳掃描成 PDF 的文件(最大 50MB),選好要辨識第幾頁到第幾頁,工具會把每一頁轉成圖片交給 AI 讀出文字,結果依頁標示、可以直接修改,再複製或下載成 TXT;輸出的是純文字,不會產生可搜尋的 PDF 檔。
適合哪些 PDF
- 掃描文件:紙本文件用掃描器或手機掃描 App 存成的 PDF,裡面每一頁其實是一張圖。
- 圖片組成的 PDF:由照片或截圖合併成的 PDF。
- 舊文件、書籍數位化:想把舊資料的文字抄出來再編輯、整理。
- 掃描的合約或公文:需要引用其中幾段文字,又不想逐字重打。
如果 PDF 本來就是用 Word 等軟體轉出來的文字型 PDF,直接在閱讀器裡選取複製就好,不需要 OCR。
逐頁辨識怎麼進行
- 頁數範圍:載入後會顯示總頁數,可以指定從第幾頁辨識到第幾頁。每一頁用掉 1 次當天的文字辨識次數,預設只幫你選今天剩餘次數夠用的前幾頁。
- 空白頁自動跳過:整頁幾乎全白的頁面不會送去辨識,也不扣次數,結果裡會標成「空白頁,已跳過」。
- 依頁標示:結果用「--- 第 N 頁 ---」分隔,辨識時有進度條顯示正在處理哪一頁;頁數多就要等比較久。
- 失敗的頁看得出來:次數用完或短時間送太快時,後面的頁會停下並標成「未辨識」;其他原因失敗的頁標成「辨識失敗」。之後可以只選那幾頁再跑一次。
- 輸出語言:語言選單是告訴 AI 要用哪種文字輸出(例如繁體或簡體中文),一般保留「自動偵測」即可;選了跟文件不同的語言,結果可能被改寫成那個語言。
辨識完可以做什麼
| 功能 | 不登入 | 登入後 |
|---|---|---|
| 直接修改結果文字、複製、下載 TXT | 可以 | 可以 |
| 用 AI 整理段落與標點、翻譯結果(同樣受每日次數限制) | 可以 | 可以 |
| 回報辨識錯誤 | — | 可以 |
| 匯出 Word(.docx)或用瀏覽器列印成 PDF | — | 可以 |
| 指定輸出格式範本、儲存常用設定 | — | 可以 |
| 辨識紀錄自動存進 OCR 歷史紀錄 | — | 可以 |
每天可辨識的頁數不登入與登入後不同,以頁面上顯示的剩餘次數為準;空白頁不扣次數。
要從 PDF 或文件拿出文字,該用哪個工具
| 手上的東西 | 怎麼判斷 | 建議 |
|---|---|---|
| Word 轉出來的 PDF | 用閱讀器可以反白選取文字 | 直接選取複製;要整份變成可編輯文件用「PDF 轉 Word」,不需要 OCR |
| 掃描的 PDF、多頁圖片 PDF | 反白選不到字,整頁像一張圖 | 用這個 PDF OCR,逐頁辨識 |
| 手機拍的文件照片、截圖 | 是 JPG、PNG 圖檔 | 用「圖片文字辨識」,可以框選只辨識一部分 |
| 有格線的表格 | 報表、價目表 | 用「表格辨識」,結果可以轉成 Excel |
| 手寫筆記 | 手寫字 | 用「手寫辨識」 |
不確定是不是掃描檔:在 PDF 閱讀器裡按 Ctrl+A(全選),文字會變成反白就是文字型 PDF;整頁沒反應或只有邊框被選到,就是掃描檔。
提高辨識品質的小技巧
- 掃描時文字要清楚、頁面不要歪斜或有陰影,辨識錯字會少很多。
- 工具會把每頁以原尺寸的 1.5 倍轉成圖片再辨識;字特別小的頁面(例如密密麻麻的註腳)可能讀不清楚,建議改用圖片 OCR 對那一頁放大截圖辨識。
- 辨識完一定要對照原文看一遍,數字、專有名詞與表格最容易出錯;結果框可以直接修改。
每一頁會在您的瀏覽器裡先轉成圖片,再上傳到伺服器交給 AI 模型辨識,所以這個工具不是純本機處理;PDF 檔本身不會整份上傳。
PDF OCR 工具功能特點
- 支援多頁 PDF 辨識
- AI 智能文字辨識
- 支援掃描文件
- 逐頁顯示辨識結果
- 支援匯出文字檔案
- 支援中英文等多種語言
如何使用PDF OCR 工具?
- 上傳 PDF 檔案
- 選擇要辨識的頁面
- 等待 AI 辨識處理
- 查看各頁辨識結果
- 複製或下載文字
PDF OCR 工具常見問題
可以辨識所有類型的 PDF 嗎?
本工具主要針對掃描型 PDF(圖片型)。如果 PDF 本身就是文字型,可以直接複製文字,不需要 OCR。
多頁 PDF 會很慢嗎?
每一頁會用掉 1 次當天的文字辨識次數(不登入每天 3 次、免費登入後每天 10 次)。開始前可以指定從第幾頁到第幾頁,預設只選今天次數夠用的頁數;次數用完時,沒辨識到的頁會標出來,隔天可以只補那幾頁。
掃描版 PDF 也能辨識嗎?
是的,本工具專門針對掃描版 PDF 進行文字辨識。它會將 PDF 的每一頁轉換為圖片後進行 OCR 處理,最終輸出可搜尋、可複製的文字內容。
掃描的 PDF 辨識完可以轉成 Word 嗎?
可以,免費登入後辨識結果下方有「匯出 Word」,存成 .docx;不登入時可以複製文字或下載 TXT,再自己貼進 Word。輸出的是文字內容,原本的版面、圖片與表格線不會照原樣重現。
辨識完會變成可以搜尋的 PDF 嗎?
不會。這個工具輸出的是純文字(可修改、複製、下載 TXT,登入後可匯出 Word),不會在原 PDF 上疊一層可搜尋的文字;需要可搜尋 PDF 的話,要用電腦上有這個功能的 PDF 軟體。
文字型 PDF 要怎麼提取文字?
不需要 OCR:在 PDF 閱讀器裡直接選取複製即可;要整份轉成可以編輯的文件,用本站「PDF 轉 Word」。只有掃描檔或圖片組成的 PDF,才需要用 PDF OCR 逐頁辨識。