OCR PDF:產生可搜尋的 PDF
把家中的掃描文件轉成帶有可選取文字的 PDF,之後能搜尋、複製內容;支援英文、西班牙文和俄文,最多 10 頁。 檔案保留在瀏覽器中。
辨識檔案首次使用時約 26 MB,另加語言資料。
辨識出的文字
這個工具有幫助嗎?
試用範例
下載範例選擇「繁體中文」。下載 PDF,搜尋「發票」、148.50、「出貨」和 2048。兩頁看起來都應與範例相同,且文字可選取、複製。
預期結果
每一頁會依序當作圖片辨識。可選擇英語、俄語與混合辨識。OCR 可能誤判字母、數字、欄與表格,請檢查結果。 這會以轉譯後的頁面圖片與隱形的文字層建立新的 PDF。可見的頁面大小與旋轉會保留;表單、連結、書籤、附件與數位簽章不會保留。既有的文字會重新辨識;圖片品質受限於轉譯解析度。
每頁最多轉譯為 4 百萬像素。載入與每個處理步驟最多 90 秒;整個工作會在 10 分鐘後停止。空白頁會在文字中標示。處理失敗或未辨識出任何文字時,不提供下載。
受保護的 PDF?請先用密碼解鎖。
第一次執行時可能需要下載轉換器檔案,會花上一些時間。若失敗,請檢查網路連線,或改用較小的檔案。「取消」會停止進行中的處理,之後可選擇其他檔案重試。
實用指南
讓掃描檔終於能搜尋
- 選擇不超過 10 頁、10 MiB 的掃描版 PDF。
- 選擇英文、西班牙文或俄文,然後執行辨識。
- 在結果中搜尋一個已知的字詞,確認文字層可以使用。
試用這個範例
用英文辨識一份 3 頁的掃描學校表單;在結果 PDF 中搜尋第 2 頁印有的姓名,應能找到並標示出來。
開始之前: 辨識僅支援英文、西班牙文和俄文,且限制為 10 頁和 10 MiB;手寫內容或非常小的字可能無法辨識。