OCR de PDF: criar PDF pesquisável
Transforme um documento digitalizado em PDF com texto selecionável para pesquisar e copiar; aceita inglês, espanhol, português e russo, até 10 páginas. Seus arquivos ficam no seu navegador.
Arquivos de reconhecimento ≈ 26 MB no primeiro uso, mais os dados de idioma.
Texto reconhecido
Esta ferramenta foi útil?
Testar com um exemplo
Baixar exemploDeixe o idioma Português selecionado. Baixe o PDF e pesquise por FATURA, 148,50, João, ENTREGA e 2048. As duas páginas devem ficar iguais ao exemplo, com texto que você pode selecionar e copiar; acentos e cedilha são preservados.
O que esperar
Cada página é reconhecida como imagem, em ordem. Estão disponíveis o reconhecimento em inglês, em russo e misto. O OCR pode ler letras, números, colunas e tabelas de forma errada: revise o resultado. Isso cria um novo PDF a partir de imagens das páginas renderizadas e de uma camada de texto invisível. O tamanho visível da página e a rotação são mantidos; formulários, links, marcadores, anexos e assinaturas digitais não são mantidos. O texto existente é reconhecido de novo; a qualidade da imagem é limitada pela resolução de renderização.
As páginas são renderizadas com até 4 megapixels cada. O carregamento e cada etapa de processamento podem levar até 90 segundos; o trabalho inteiro é interrompido após 10 minutos. Páginas em branco são marcadas no texto. Nenhum download é oferecido se o processamento falhar ou se nenhum texto for reconhecido.
PDF protegido?Desbloqueie-o primeiro com a senha dele.
Na primeira execução, os arquivos do conversor podem ser baixados e isso pode levar um momento. Se falhar, verifique sua conexão ou tente um arquivo menor. “Cancelar” interrompe o processamento em andamento; você pode selecionar outro arquivo e tentar novamente.
Licenças e código-fonte dos motores
Um guia prático
Deixe a digitalização pesquisável de uma vez.
- Selecione um PDF digitalizado de até 10 páginas e 10 MiB.
- Escolha inglês, espanhol, português ou russo e execute o reconhecimento.
- Pesquise uma palavra conhecida no resultado para confirmar que a camada de texto funciona.
Teste este exemplo
Reconheça em português um formulário escolar digitalizado de 3 páginas; pesquisar um nome impresso na página 2 deve destacá-lo no PDF resultante.
Antes de começar: O reconhecimento aceita só inglês, espanhol, português e russo e se limita a 10 páginas e 10 MiB; o resultado pode deixar passar escrita à mão ou letras muito pequenas.