OCR PDF: een PDF doorzoekbaar maken
Maak van een gescand document een PDF met selecteerbare tekst om in te zoeken en te kopiëren; Nederlands, Engels, Spaans en Russisch, tot 10 pagina's. Je bestanden blijven in je browser.
Herkenningsbestanden ≈ 26 MB bij het eerste gebruik, plus taalgegevens.
Herkende tekst
Was deze tool nuttig?
Voorbeeld proberen
Voorbeeld downloadenLaat de taal op Nederlands staan. Download de PDF en zoek naar FACTUUR, 148,50, Ruël, LEVERING en 2048. Beide pagina's zien eruit als het voorbeeld, met tekst die je kunt selecteren en kopiëren; accenten en trema's blijven behouden.
Wat je kunt verwachten
Elke pagina wordt in volgorde als afbeelding herkend. Herkenning in het Engels, Russisch en gemengd is beschikbaar. OCR kan letters, cijfers, kolommen en tabellen verkeerd lezen: controleer het resultaat. Hiermee maak je een nieuwe PDF van weergegeven paginabeelden en een onzichtbare tekstlaag. De zichtbare paginagrootte en rotatie blijven behouden; formulieren, links, bladwijzers, bijlagen en digitale handtekeningen blijven niet behouden. Bestaande tekst wordt opnieuw herkend; de beeldkwaliteit wordt beperkt door de weergaveresolutie.
Pagina's worden weergegeven tot maximaal 4 megapixels per pagina. Laden en elke verwerkingsstap mogen maximaal 90 seconden duren; de hele taak stopt na 10 minuten. Lege pagina's worden in de tekst gemarkeerd. Er wordt geen download aangeboden als de verwerking mislukt of er geen tekst wordt herkend.
Beveiligde PDF?Ontgrendel hem eerst met het wachtwoord.
Bij de eerste keer kunnen er converterbestanden worden gedownload, wat even kan duren. Controleer bij een fout je verbinding of probeer een kleiner bestand. Met “Annuleren” stop je de lopende verwerking; je kunt dan een ander bestand kiezen en het opnieuw proberen.
Licenties en broncode van de engines
Een praktische gids
Maak een scan eindelijk doorzoekbaar.
- Kies een gescande PDF van maximaal 10 pagina's en 10 MiB.
- Selecteer Nederlands, Engels, Spaans of Russisch en start de herkenning.
- Zoek in het resultaat naar een bekend woord om te controleren of de tekstlaag werkt.
Probeer dit voorbeeld
Laat een gescand schoolformulier van 3 pagina's in het Nederlands herkennen; zoeken naar een naam die op pagina 2 staat hoort die in de PDF die je krijgt te markeren.
Voordat je begint: De herkenning ondersteunt alleen Nederlands, Engels, Spaans en Russisch en is beperkt tot 10 pagina's en 10 MiB; handschrift of heel kleine letters kunnen worden gemist.