你的檔案會留在你的裝置上

檔案在你的瀏覽器中處理,不會上傳到我們的伺服器。網站可能會下載處理引擎,並傳送不含檔案內容的使用或回饋事件。

我們如何處理你的資料

OCR PDF:產生可搜尋的 PDF

把家中的掃描文件轉成帶有可選取文字的 PDF,之後能搜尋、複製內容;支援英文、西班牙文和俄文,最多 10 頁。 檔案保留在瀏覽器中。

辨識檔案首次使用時約 26 MB,另加語言資料。

PDF · 最大 10 MiB,10 頁。文字最大 1 MiB;可搜尋的 PDF 最大 30 MiB。

辨識出的文字

試用範例

下載範例

選擇「繁體中文」。下載 PDF,搜尋「發票」、148.50、「出貨」和 2048。兩頁看起來都應與範例相同,且文字可選取、複製。

預期結果

每一頁會依序當作圖片辨識。可選擇英語、俄語與混合辨識。OCR 可能誤判字母、數字、欄與表格,請檢查結果。 這會以轉譯後的頁面圖片與隱形的文字層建立新的 PDF。可見的頁面大小與旋轉會保留;表單、連結、書籤、附件與數位簽章不會保留。既有的文字會重新辨識;圖片品質受限於轉譯解析度。

每頁最多轉譯為 4 百萬像素。載入與每個處理步驟最多 90 秒;整個工作會在 10 分鐘後停止。空白頁會在文字中標示。處理失敗或未辨識出任何文字時,不提供下載。

受保護的 PDF?請先用密碼解鎖。

第一次執行時可能需要下載轉換器檔案,會花上一些時間。若失敗,請檢查網路連線,或改用較小的檔案。「取消」會停止進行中的處理,之後可選擇其他檔案重試。

引擎授權與原始碼

實用指南

讓掃描檔終於能搜尋

  1. 選擇不超過 10 頁、10 MiB 的掃描版 PDF。
  2. 選擇英文、西班牙文或俄文,然後執行辨識。
  3. 在結果中搜尋一個已知的字詞,確認文字層可以使用。

試用這個範例

用英文辨識一份 3 頁的掃描學校表單;在結果 PDF 中搜尋第 2 頁印有的姓名,應能找到並標示出來。

開始之前: 辨識僅支援英文、西班牙文和俄文,且限制為 10 頁和 10 MiB;手寫內容或非常小的字可能無法辨識。