你的檔案會留在你的裝置上

檔案在你的瀏覽器中處理,不會上傳到我們的伺服器。網站可能會下載處理引擎,並傳送不含檔案內容的使用或回饋事件。

我們如何處理你的資料

PDF 轉 HTML

PDF 轉 HTML:將家用指南既有的文字存成簡單的網頁,每個來源頁面各成一個段落。圖片和版面不會包含在內。

合成範例,執行前請檢查操作設定。

你的文件會留在此裝置上。工具下載和使用統計不包含檔案內容。

本機限制: 單一檔案大小上限: 10 MB

檔案在瀏覽器中處理,不會上傳到本網站。

實用指南

在本機開啟依頁面整理的文字副本

  1. 選擇含有可選取文字的 PDF。
  2. 匯出 HTML,在本機開啟下載的檔案。
  3. 重複使用之前,對照原始檔檢查頁面段落和字句。

試試這個範例

將可搜尋的兩頁常見問題 PDF 匯出為 HTML。在本機開啟,確認每個答案都出現在它來源頁面的段落下,並且不會被當成可執行的標記語言。

之前

  • 含文字的 PDF 頁面

之後

  • HTML 頁面區段
此任務的輸入與預期結果 示意範例。

開始之前: HTML 只包含已跳脫的文字;原始的字型、圖片和版面不會保留,掃描檔也不會做 OCR。

繼續處理來源 PDF
你會得到

將內嵌文字匯出為獨立的 HTML 文件,每頁一個區段。文字會經過跳脫,不會當作 HTML 執行。不保留原始字型、圖片、表格與版面;不含 OCR。限制:輸入 10 MiB、200 頁、輸出 4 MiB。

限制與重要說明

輸入最大 10 MiB、200 頁,文字輸出最大 4 MiB。沒有文字圖層的掃描文件會顯示錯誤,而不是假裝成功擷取。閱讀順序、欄位與字型可能與畫面上的版面不一致。這不是 OCR,也不是 PDF 轉 Word。

範例

匯出以文字為主的報告,並在本機開啟下載的 HTML。各區段依 PDF 頁面順序排列;空白或掃描頁面會加上標示,而不是被默默當成已辨識的文字。