你的檔案會留在你的裝置上
檔案在你的瀏覽器中處理,不會上傳到我們的伺服器。網站可能會下載處理引擎,並傳送不含檔案內容的使用或回饋事件。
我們如何處理你的資料PDF 轉 HTML
PDF 轉 HTML:將家用指南既有的文字存成簡單的網頁,每個來源頁面各成一個段落。圖片和版面不會包含在內。
合成範例,執行前請檢查操作設定。
你的文件會留在此裝置上。工具下載和使用統計不包含檔案內容。
本機限制: 單一檔案大小上限: 10 MB
檔案在瀏覽器中處理,不會上傳到本網站。
實用指南
在本機開啟依頁面整理的文字副本
- 選擇含有可選取文字的 PDF。
- 匯出 HTML,在本機開啟下載的檔案。
- 重複使用之前,對照原始檔檢查頁面段落和字句。
試試這個範例
將可搜尋的兩頁常見問題 PDF 匯出為 HTML。在本機開啟,確認每個答案都出現在它來源頁面的段落下,並且不會被當成可執行的標記語言。
之前
- 含文字的 PDF 頁面
之後
- HTML 頁面區段
開始之前: HTML 只包含已跳脫的文字;原始的字型、圖片和版面不會保留,掃描檔也不會做 OCR。
繼續處理來源 PDF你會得到
將內嵌文字匯出為獨立的 HTML 文件,每頁一個區段。文字會經過跳脫,不會當作 HTML 執行。不保留原始字型、圖片、表格與版面;不含 OCR。限制:輸入 10 MiB、200 頁、輸出 4 MiB。
限制與重要說明
輸入最大 10 MiB、200 頁,文字輸出最大 4 MiB。沒有文字圖層的掃描文件會顯示錯誤,而不是假裝成功擷取。閱讀順序、欄位與字型可能與畫面上的版面不一致。這不是 OCR,也不是 PDF 轉 Word。
範例
匯出以文字為主的報告,並在本機開啟下載的 HTML。各區段依 PDF 頁面順序排列;空白或掃描頁面會加上標示,而不是被默默當成已辨識的文字。