OCR PDF: tee PDF-tiedostosta haettava
Tee skannatusta asiakirjasta PDF, jossa on valittavaa tekstiä haettavaksi ja kopioitavaksi; suomi, englanti, espanja ja venäjä, enintään 10 sivua. Tiedostosi pysyvät selaimessasi.
Tunnistustiedostot ≈ 26 MB ensimmäisellä käyttökerralla sekä kielitiedot.
Tunnistettu teksti
Oliko tämä työkalu hyödyllinen?
Kokeile esimerkkiä
Lataa esimerkkiJätä kieleksi valituksi Suomi. Lataa PDF-tiedosto ja hae sanoja LASKU, 148,50, Mäkelä, TOIMITUS ja 2048. Molempien sivujen pitäisi näyttää esimerkiltä, ja tekstin pitäisi olla valittavissa ja kopioitavissa; ä ja ö säilyvät.
Mitä odottaa
Jokainen sivu tunnistetaan kuvana järjestyksessä. Tunnistus on saatavilla englanniksi, venäjäksi ja sekakielisenä. OCR voi lukea kirjaimia, numeroita, sarakkeita ja taulukoita väärin: tarkista tulos. Tämä luo uuden PDF-tiedoston renderöidyistä sivukuvista ja näkymättömästä tekstitasosta. Näkyvä sivukoko ja kierto säilyvät; lomakkeet, linkit, kirjanmerkit, liitteet ja digitaaliset allekirjoitukset eivät säily. Olemassa oleva teksti tunnistetaan uudelleen; kuvan laatua rajoittaa renderöinnin tarkkuus.
Sivut renderöidään enintään 4 megapikselin kokoisina. Lataus ja jokainen käsittelyvaihe saavat kestää enintään 90 sekuntia; koko työ päättyy 10 minuutin kuluttua. Tyhjät sivut merkitään tekstiin. Latausta ei tarjota, jos käsittely epäonnistuu tai tekstiä ei tunnisteta.
Suojattu PDF?Poista sen suojaus ensin salasanalla.
Ensimmäisellä ajokerralla muunnintiedostot voidaan ladata, ja se voi kestää hetken. Jos se epäonnistuu, tarkista yhteytesi tai kokeile pienempää tiedostoa. Peruuta-painike pysäyttää käynnissä olevan käsittelyn; voit valita toisen tiedoston ja yrittää uudelleen.
Moottoreiden lisenssit ja lähdekoodi
Käytännön opas
Tee skannauksesta vihdoin haettava.
- Valitse skannattu PDF, jossa on enintään 10 sivua ja jonka koko on enintään 10 MiB.
- Valitse suomi, englanti, espanja tai venäjä ja käynnistä tekstintunnistus.
- Hae tuloksesta tuttua sanaa varmistaaksesi, että tekstitaso toimii.
Kokeile tätä esimerkkiä
Tunnista 3-sivuinen skannattu koululomake (kieli: suomi); sivulle 2 painetun nimen haun pitäisi korostaa nimi tuloksena syntyvässä PDF:ssä.
Ennen aloittamista: Tekstintunnistus tukee vain suomea, englantia, espanjaa ja venäjää, ja se on rajattu 10 sivuun ja kokoon 10 MiB; käsinkirjoitus tai hyvin pieni teksti voi jäädä tunnistamatta.