Dine filer bliver på din enhed

Filer behandles i din browser og uploades ikke til vores servere. Webstedet kan hente behandlingsmotorer og sende brugs- eller feedbackhændelser uden filindhold.

Sådan behandler vi dine data →

PDF til HTML

Konverter PDF til HTML: gem den eksisterende tekst i en husguide som en enkel webside med ét afsnit for hver kildeside. Billeder og layout udelades.

Syntetisk eksempel – gennemgå handlingens indstillinger, før du kører den.

Dine dokumenter bliver på denne enhed. Download af værktøjerne og brugsstatistik indeholder ikke filindhold.

Grænser på din enhed: Maks. størrelse pr. fil: 10 MB

Dine filer behandles i din browser. De uploades ikke til dette websted.

Praktisk vejledning

Åbn en sideopdelt tekstkopi lokalt.

  1. Vælg en PDF med markérbar tekst.
  2. Eksportér HTML, og åbn den downloadede fil lokalt.
  3. Sammenlign sideafsnittene og ordlyden med originalen, før du bruger dem igen.

Prøv dette eksempel

Eksportér en søgbar FAQ-PDF på to sider til HTML. Åbn den lokalt, og bekræft, at hvert svar står under sit kildesideafsnit uden at blive behandlet som kørbar kode.

Før

  • PDF-sider med tekst

Efter

  • HTML-sideafsnit
Det, du lægger ind, og det forventede resultat af denne opgave. Illustrerende eksempel.

Før du starter: HTML-filen indeholder kun tekst med escape-tegn; de oprindelige skrifttyper, billeder og layout bevares ikke, og scanninger køres ikke gennem OCR.

Fortsæt med kilde-PDF'en
Resultat

Eksporter indlejret tekst til et selvstændigt HTML-dokument med ét afsnit pr. side. Teksten escapes og køres ikke som HTML. Originale skrifttyper, billeder, tabeller og layout bevares ikke; ingen OCR. Grænser: 10 MiB input, 200 sider, 4 MiB output.

Grænser og vigtige detaljer

Højst 10 MiB input, 200 sider og 4 MiB tekstoutput. Scannede dokumenter uden tekstlag giver en fejl i stedet for et falsk vellykket udtræk. Læserækkefølge, spalter og skrifttyper svarer måske ikke til det visuelle layout. Det er hverken OCR eller PDF til Word.

Eksempel

Eksporter en tekstbaseret rapport, og åbn den downloadede HTML lokalt. Afsnittene følger PDF-filens siderækkefølge; tomme/scannede sider mærkes i stedet for stiltiende at blive behandlet som genkendt tekst.