Fájljai az eszközén maradnak

A fájlokat a böngészőjében dolgozzuk fel, és nem töltjük fel a szervereinkre. Az oldal letölthet feldolgozómotorokat, és a fájlok tartalma nélkül küldhet használati vagy visszajelzési eseményeket.

Hogyan kezeljük az adatait →

PDF-ből HTML

Alakítsa a PDF-et HTML-lé: mentse egy otthoni útmutató meglévő szövegét egyszerű weboldalként, forrásoldalanként egy szakasszal. Kép és elrendezés nélkül.

Szintetikus példa – futtatás előtt ellenőrizze a művelet beállításait.

A dokumentumai ezen az eszközön maradnak. Az eszközök letöltése és a használati statisztikák nem tartalmazzák a fájlok tartalmát.

Korlátok az eszközén: Legnagyobb fájlméret: 10 MB

A fájlokat a böngésző dolgozza fel. Nem kerülnek feltöltésre erre a webhelyre.

Gyakorlati útmutató

Nyisson meg helyben egy oldalakra bontott szövegpéldányt.

  1. Válasszon ki egy kijelölhető szöveget tartalmazó PDF-et.
  2. Exportáljon HTML-t, és nyissa meg a letöltött fájlt helyben.
  3. Újrahasznosítás előtt vesse össze az oldalszakaszokat és a szöveget az eredetivel.

Próbálja ki ezt a példát

Exportáljon egy kereshető, kétoldalas GYIK-PDF-et HTML-be. Nyissa meg helyben, és ellenőrizze, hogy minden válasz a forrásoldala szakasza alatt jelenik meg, futtatható jelölésként kezelés nélkül.

Előtte

  • PDF-oldalak szöveggel

Utána

  • HTML oldalszakaszok
A feladat bemenete és a várt eredmény. Szemléltető példa.

Mielőtt elkezdi: A HTML csak escape-elt szöveget tartalmaz; az eredeti betűtípusok, képek és elrendezés nem maradnak meg, a beolvasott oldalakon pedig nem fut OCR.

Folytassa a forrás-PDF-fel
Mit kap

A beágyazott szöveget önálló HTML-dokumentumba exportálja, oldalanként egy szakasszal. A szöveg escape-elt, nem HTML-ként fut le. Az eredeti betűtípusok, képek, táblázatok és az elrendezés nem maradnak meg; nincs OCR. Korlátok: 10 MiB bemenet, 200 oldal, 4 MiB kimenet.

Korlátok és fontos részletek

Legfeljebb 10 MiB bemenet, 200 oldal és 4 MiB szövegkimenet. A szövegréteg nélküli beolvasott dokumentumoknál hibaüzenet jelenik meg látszatsikeres kinyerés helyett. Az olvasási sorrend, az oszlopok és a betűtípusok eltérhetnek a vizuális elrendezéstől. Ez nem OCR, és nem PDF-ből Word átalakítás.

Példa

Exportáljon egy szövegalapú jelentést, és nyissa meg a letöltött HTML-t helyben. A szakaszok a PDF oldalsorrendjét követik; az üres és a beolvasott oldalak jelölést kapnak, nem kezeli őket csendben felismert szövegként.