Tiedostosi pysyvät laitteellasi

Tiedostot käsitellään selaimessasi, eikä niitä lähetetä palvelimillemme. Sivusto voi ladata käsittelymoottoreita ja lähettää käyttö- tai palautetapahtumia ilman tiedostojen sisältöä.

Näin käsittelemme tietojasi →

PDF HTML-muotoon

PDF HTML-muotoon: tallenna oppaan teksti yksinkertaisena verkkosivuna, yksi osio kutakin lähdesivua kohden. Kuvat ja asettelu jätetään pois.

Synteettinen esimerkki – tarkista toiminnon asetukset ennen sen suorittamista.

Asiakirjasi pysyvät tällä laitteella. Työkalujen lataukset ja käyttötilastot eivät sisällä tiedostojen sisältöä.

Rajoitukset laitteellasi: Yksittäinen tiedosto enintään: 10 MB

Tiedostot käsitellään selaimessasi. Niitä ei ladata tälle sivustolle.

Käytännön opas

Avaa sivuittain jäsennelty tekstikopio paikallisesti.

  1. Valitse PDF, jossa on valittavaa tekstiä.
  2. Vie HTML ja avaa ladattu tiedosto paikallisesti.
  3. Tarkista sivuosiot ja sanamuoto alkuperäiseen verraten ennen uudelleenkäyttöä.

Kokeile tätä esimerkkiä

Vie haettava kaksisivuinen UKK-PDF HTML-muotoon. Avaa se paikallisesti ja varmista, että jokainen vastaus näkyy lähdesivunsa osiossa ilman, että sitä käsitellään suoritettavana koodina.

Ennen

  • PDF-sivut, joilla on tekstiä

Jälkeen

  • HTML-sivun osiot
Tämän tehtävän syöte ja odotettu tulos. Havainnollistava esimerkki.

Ennen kuin aloitat: HTML sisältää vain muunnettua tekstiä; alkuperäisiä fontteja, kuvia ja asettelua ei säilytetä, eikä skannauksille tehdä tekstintunnistusta.

Jatka lähde-PDF:llä
Tulos

Vie upotettu teksti itsenäiseksi HTML-asiakirjaksi, jossa on yksi osio sivua kohden. Teksti koodataan turvallisesti, eikä sitä suoriteta HTML-koodina. Alkuperäisiä fontteja, kuvia, taulukoita ja asettelua ei säilytetä; ei OCR-tekstintunnistusta. Rajat: 10 MiB syötettä, 200 sivua, 4 MiB tulostetta.

Rajoitukset ja tärkeät tiedot

Enintään 10 MiB syötettä, 200 sivua ja 4 MiB tekstitulostetta. Skannatuista asiakirjoista, joissa ei ole tekstikerrosta, tulee virheilmoitus näennäisesti onnistuneen poiminnan sijaan. Lukujärjestys, sarakkeet ja fontit eivät välttämättä vastaa visuaalista asettelua. Tämä ei ole OCR-tekstintunnistusta eikä PDF Word-muotoon -muunnosta.

Esimerkki

Vie tekstipohjainen raportti ja avaa ladattu HTML-tiedosto paikallisesti. Osiot noudattavat PDF-sivujen järjestystä; tyhjät tai skannatut sivut merkitään, eikä niitä käsitellä äänettömästi tunnistettuna tekstinä.