Dine filer bliver på din enhed

Filer behandles i din browser og uploades ikke til vores servere. Webstedet kan hente behandlingsmotorer og sende brugs- eller feedbackhændelser uden filindhold.

Sådan behandler vi dine data →

PDF til tekst

Udtræk tekst fra en PDF: kopiér tekstlaget i en søgbar formular eller guide til en tekstfil til dine notater. Scanninger skal først have OCR.

Syntetisk eksempel – gennemgå handlingens indstillinger, før du kører den.

Dine dokumenter bliver på denne enhed. Download af værktøjerne og brugsstatistik indeholder ikke filindhold.

Grænser på din enhed: Maks. størrelse pr. fil: 10 MB

Dine filer behandles i din browser. De uploades ikke til dette websted.

Praktisk vejledning

Brug de ord, der allerede står i PDF'en.

  1. Vælg en PDF med markérbar tekst og ikke en scanning af trykte sider.
  2. Udtræk teksten, og se sideskift og læserækkefølge efter.
  3. Kopiér eller download TXT-resultatet, og sammenlign vigtige værdier med PDF'en.

Prøv dette eksempel

Udtræk tekst fra en søgbar ansøgningsguide på to sider, og kontrollér, at feltmærkaterne og vejledningen står i TXT-resultatet i en brugbar rækkefølge.

Før

  • Markérbar PDF-tekst

Efter

  • Almindelig tekst .txt
Det, du lægger ind, og det forventede resultat af denne opgave. Illustrerende eksempel.

Før du starter: Her læses indlejret markérbar tekst; scannede sider skal have OCR, og kolonner følger måske ikke deres visuelle rækkefølge.

Fortsæt med kilde-PDF'en
Resultat

Udtræk indlejret tekst til en TXT-fil. Scannede sider kræver OCR; kildens læserækkefølge kan afvige fra det synlige layout.

Grænser og vigtige detaljer

Højst 10 MiB input, 200 sider og 4 MiB tekstoutput. Scannede dokumenter uden tekstlag giver en fejl i stedet for et falsk vellykket udtræk. Læserækkefølge, spalter og skrifttyper svarer måske ikke til det visuelle layout. Det er hverken OCR eller PDF til Word.

Eksempel

Udtræk tekst fra en søgbar rapport, gennemse den i resultatfeltet, og kopier eller download den. De oprindelige PDF-filer er stadig tilgængelige efter tekstresultatet.