I tuoi file restano sul tuo dispositivo

I file vengono elaborati nel tuo browser e non vengono caricati sui nostri server. Il sito può scaricare motori di elaborazione e inviare eventi di utilizzo o di feedback senza il contenuto dei file.

Come trattiamo i tuoi dati →

Converti PDF in HTML

Converti PDF in HTML: salva il testo di una guida come semplice pagina web, una sezione per ogni pagina di origine. Immagini e layout restano fuori.

Esempio sintetico — controlla le impostazioni dell’operazione prima di avviarla.

I tuoi documenti restano su questo dispositivo. I download degli strumenti e le statistiche d’uso non includono il contenuto dei file.

Limiti sul tuo dispositivo: Max. per singolo file: 10 MB

I file vengono elaborati nel tuo browser. Non vengono caricati su questo sito.

Guida pratica

Apri in locale una copia del testo organizzata per pagine.

  1. Scegli un PDF con testo selezionabile.
  2. Esporta l'HTML e apri in locale il file scaricato.
  3. Controlla sezioni di pagina e formulazioni rispetto all'originale prima di riutilizzarle.

Prova questo esempio

Esporta in HTML un PDF di FAQ ricercabile di due pagine. Aprilo in locale e conferma che ogni risposta compaia sotto la sezione della sua pagina di origine, senza essere trattata come codice eseguibile.

Prima

  • Pagine PDF con testo

Dopo

  • Sezioni di pagina HTML
Input e risultato atteso di questa operazione. Esempio illustrativo.

Prima di iniziare: L'HTML contiene solo testo con caratteri di escape; caratteri, immagini e layout originali non vengono conservati e le scansioni non passano per l'OCR.

Continua con il PDF di origine
Risultato

Esporta il testo incorporato in un documento HTML autonomo con una sezione per pagina. Il testo viene sottoposto a escape, non eseguito come HTML. Font, immagini, tabelle e layout originali non vengono conservati; niente OCR. Limiti: 10 MiB in ingresso, 200 pagine, 4 MiB in uscita.

Limiti e dettagli importanti

Al massimo 10 MiB in ingresso, 200 pagine e 4 MiB di testo in uscita. I documenti scansionati senza livello di testo generano un errore invece di simulare un’estrazione riuscita. Ordine di lettura, colonne e font possono non corrispondere al layout visivo. Non è OCR né una conversione da PDF a Word.

Esempio

Esporta un rapporto basato su testo e apri in locale l’HTML scaricato. Le sezioni seguono l’ordine delle pagine del PDF; le pagine vuote o scansionate vengono etichettate invece di essere trattate in silenzio come testo riconosciuto.