Je bestanden blijven op je apparaat
Bestanden worden in je browser verwerkt en niet naar onze servers geüpload. De site kan verwerkingsengines downloaden en gebruiks- of feedbackgebeurtenissen verzenden zonder bestandsinhoud.
Zo gaan we met je gegevens om →PDF naar HTML
PDF naar HTML: bewaar de bestaande tekst van een gids als eenvoudige webpagina, één onderdeel per bronpagina. Zonder afbeeldingen of opmaak.
Synthetisch voorbeeld – controleer de instellingen van de bewerking voordat je die uitvoert.
Je documenten blijven op dit apparaat. Downloads van de tools en gebruiksstatistieken bevatten geen bestandsinhoud.
Limieten op je apparaat: Max. grootte van één bestand: 10 MB
Je bestanden worden in je browser verwerkt. Ze worden niet naar deze site geüpload.
Praktische gids
Open lokaal een tekstkopie per pagina.
- Kies een PDF met selecteerbare tekst.
- Exporteer HTML en open het gedownloade bestand lokaal.
- Controleer de pagina-onderdelen en de tekst met het origineel voordat je ze opnieuw gebruikt.
Probeer dit voorbeeld
Exporteer een doorzoekbare PDF met veelgestelde vragen van twee pagina's naar HTML. Open hem lokaal en controleer of elk antwoord onder het onderdeel van zijn bronpagina staat en niet als uitvoerbare opmaak wordt behandeld.
Voor
- PDF-pagina's met tekst
Na
- HTML-paginasecties
Voordat je begint: De HTML bevat alleen geëscapete tekst; oorspronkelijke lettertypen, afbeeldingen en opmaak blijven niet behouden en scans krijgen geen OCR.
Verdergaan met de bron-PDFResultaat
Exporteer ingebedde tekst naar een zelfstandig HTML-document met één sectie per pagina. Tekst wordt geëscaped en niet als HTML uitgevoerd. Oorspronkelijke lettertypen, afbeeldingen, tabellen en opmaak blijven niet behouden; geen OCR. Limieten: 10 MiB invoer, 200 pagina's, 4 MiB uitvoer.
Limieten en belangrijke details
Maximaal 10 MiB invoer, 200 pagina's en 4 MiB tekstuitvoer. Gescande documenten zonder tekstlaag geven een foutmelding in plaats van een schijnbaar geslaagde extractie. Leesvolgorde, kolommen en lettertypen komen mogelijk niet overeen met de zichtbare opmaak. Dit is geen OCR en geen PDF naar Word.
Voorbeeld
Exporteer een rapport op tekstbasis en open de gedownloade HTML lokaal. De secties volgen de paginavolgorde van de PDF; lege of gescande pagina's krijgen een label en worden niet stilzwijgend als herkende tekst behandeld.